结论:更新 jairl,不更新 jaiv1;四道母题置信度不动。三份材料构成「Anthropic 专题深挖—中国模型产品数据—AI 总研究地图」三层体系,框架覆盖面很强,但证据质量没有随层级统一。可沉淀的是研究结构和两条数据质量反证;不可沉淀的是产品份额、增长趋势、护城河或商业胜负。

材料对象与证据等级

Anthropic.xlsx

23 个工作表,覆盖公司起源、治理与宪法、人物、AGI 时间表、训练路线、Claude Code Harness 与推理经济学。属于协作方汇编底稿,整份定为三级;只有逐条回到官方文件、论文或原始访谈的项目才可单独升级。

中国模型公司产品2.xlsx

14 个工作表,覆盖国内 AI 产品、办公 Agent、视频产品、渠道与用户数据。来源口径、日期和统计对象不统一,且存在时间倒挂与疑似插值序列,不能直接作为趋势证据。

AI大模型.xmind

1 个画布、972 个节点、最大 12 层。它是研究导航与问题地图,不是证据账本;节点覆盖面不能替代来源链、日期和反证条件。

两条硬反证

  1. TraeWork 数据早于产品发布。工作簿列出 2026 年 3–5 月产品数据,同时在自身时间线记载 6 月 9 日发布。除非字段实际指向前身产品、内测或另一统计对象,否则时间上不可能成立。该序列在来源与对象澄清前全部拒绝入账。
  2. 可灵/海螺多个月序列呈机械等差变化。真实月度观测通常包含活动、投放、版本、渠道和季节性扰动;连续机械步进更像插值、补齐或合成。没有原始月表与计算方法前,只能作为制图占位,不能用于增长率、份额或拐点判断。

什么可以保留

结构层交叉验证:三份材料再次收敛到同一系统边界:真实竞争单位不是单模型,而是模型、Context、Tools、Harness、权限、验证与任务预算的组合。这与研究卡 030035 已有结论一致,因此只算加固,不算新发现。

研究治理增量:总地图、专题深挖与数据表必须共享同一证据字段:来源、日期、统计对象、采集方法、证据等级、反证条件。否则地图越大,只会更快复制同一处错误。

为什么不更新 jaiv1

jaiv1 已经明确把价值捕获放在模型之外的系统、工作流、企业上下文和验证层。本批没有提供新的公司财务、续费、迁移率、任务成功率或每成功任务全成本,无法改变五条商业预测。把三级汇编再次写成商业结论,只会制造重复与伪精确。

对四道母题的影响

下一次只接受什么

  1. TraeWork 各月份数据的原始来源、字段定义,以及与 6 月 9 日发布日的对象对应关系。
  2. 可灵/海螺月度序列的原始下载表、采集日期和插值说明;若为估算,必须保留上下界而非单点。
  3. Anthropic benchmark 的版本、工具条件、采样设置与独立复现。
  4. 能裁决商业判断的任务成功率、续费/扩单、跨模型迁移率和每成功任务全成本。

材料边界

隐私与可复核性

三份原文件来自内部协作材料,不公开下载、不公开作者身份、不转载受限表格。本卡只公开审计方法、材料结构和足以解释拒绝入账的错误类型。证据账本登记为 E-028(三级),不改变任何母题置信度。