结论:四类最接近证据,0 个闭合“生成世界 → 真实 Agent 增益”因果链。生成环境、想象训练和真实机器人规划分别成立,但公开材料没有同一任务下加入生成世界前后的真实成功率、失败与成本对照。Q3 维持 65%。

唯一有效的因果链

输入

明确哪些训练轨迹来自生成世界,数量、覆盖范围与生成成本可核验。

对照

同一策略、真实数据、算力与训练预算下,有生成世界 vs 无生成世界。

输出

真实任务成功率、失败类型、接管、安全事件、样本效率和迁移成本同时披露。

四类候选为何不能结算

三种禁止偷换

当前判断

“无限合成环境”目前是供给能力和研究方向,不是已经兑现的 Agent 价值。最可能先兑现的用途是稀有场景覆盖、危险事件复现和评测扩容,但这仍需真实任务对照。当前四类证据全部标 BLOCKED,不调整 Q3。

唯一允许升级的数据包

至少三个独立真实流程,随机或严格匹配比较 real-only、real+传统模拟、real+生成世界;公开真实成功率、长尾失败、接管、安全事件、所需真实样本、合成生成/筛选/训练成本与复现实验。只有真实增益覆盖新增成本和风险,才把生成世界结算为生产资产。

来源