分析内核 = InfiniSynapse Server API(先连 SSE 再 newTask);判定引擎 = 本服务内的确定性代码。 下面每个集成点都挂着真实任务 ID,可在平台后台查验日志。
全程 SSE 直播(挖掘现场);事件持久化 task_events,断线快照恢复;口径卡经 saveToRag 固化知识库(裁决后异步回写)。
| 能力 | 端点 | 真实引用 |
|---|---|---|
| 长任务执行 | GET /api/ai/events → POST /api/ai/message (newTask) | 核查任务 c1ae1033-63af-457c-bbbf-87ef52f68ba3 |
| AI 建档 | 同上(建档任务模板) | 6880ef84-1b8d-42db-a04a-eb2f6553c13c(20.6 分钟 · 254 事件) |
| 增量重验 | POST /api/ai/message (askResponse 追问原任务) | 实测 21–24s(本栈三连测) |
| 口径知识库 | saveToRag / isSavedToRag | e25aad8f-0a94-42b1-9645-58f9d092c79a |
| 数据源注册 | testConnection / add(凭据瞬时过境,不落库) | MySQL(山丘业务库)+ 任务内 Excel 底稿 |
| 任务分享 | setShare / publicTask | 快照页「查看原始分析任务」证据链接 |
没有数据库也能核:把 Excel/CSV 底稿上传为真数源,鼹鼠把报告数字对着底稿逐条重算(报告 ↔ 底稿勾稽)。统计局、交易所、行业报告里的公开数据,自行下载整理成结构化表格后上传,即可作为核对基准。鼹鼠不代抓取公开数据、不背书其权威性——核对基准由你自备,结论只对「报告与底稿是否一致」负责。
| 指标 | 要求 | 实测 / 说明 | 状态 |
|---|---|---|---|
| N1 单条增量重验 | < 15 秒 | 实测 21–24 秒(本栈连续三次:23.6/21.2/23.0s);受平台负载影响波动,全程秒表直播 | 波动 · 如实标注 |
| N2 真实任务 ID | 平台后台可查日志 | 建档/核查/重验/审单全部挂真实任务 ID(本页与工作台/快照页可见) | 达标 |
| N3 ❌ 确定性 | 判定零 LLM | verdict-engine 纯函数(25 项全分支单测);全站无"可信度 %"合成评分 | 达标 |
| N4 数字/叙事分离 | 已核实版 ≤30 秒 | 13s;数字确定性渲染带出处徽章,叙述段标"AI 撰写 · 未核查" | 达标 |
| N5 裁决历史 | 追加式可查 | 裁决两次历史两条(含回滚),口径卡页可见 | 达标 |
| N6 凭据不落库 | DB+日志双查 | 仅注册时瞬时过境;本库只存平台数据源 ID + 脱敏 host | 达标 |
| N7 真实任务 | 主路径不摆拍 | 演示核查/重验/裁决固化全部真实发起;预生成处(审单页/建档回放)均明示并挂真实任务 ID | 达标 |
| N8 全量核查(12 条主张) | ≤ 90 秒 | 实测 133–192 秒(本栈四轮:151/151/192/133s;耗时主要在平台侧模型推理) | 约 2 分钟 · 如实标注 |
所有计时为真实任务实测(非缓存回放);核查全程有 SSE 节点直播,可随时对照平台后台日志核对。