每条格式:主张 · 理由 · 证据 · 类比 · 什么情况下会改 · 置信度(高/中/低)。
上级: 乌托邦时间线
镜像(末日失败分支): 节点 9 多边(N9 多边)、节点 3 盗窃(N3 T2 条约 / 美中)
模态基线(非乌托邦): C8 社会快照
日期: 2026-07-04
格式: 主张 | 理由 | 证据 | 类比 | 什么情况下会改 | 置信度
每一节记录 U6 — 多边有益 AI 协调的一条概率:峰会后续、部署标准、验证研发、可信(非空壳)国际 AI 治理。概率为主观判断(subjective elicitation),除非注明源自 N9/N3。
乌托邦桶: U3 乘数——国际标准降低科学红利和制度黄金时代摩擦;不直接解锁 U1/U2(无 U1/U5)。
1. 节点定义 — 有益协调 ≠ 暂停
主张: U6 = P(至 @C10,多边 AI 治理产生实质有益成果——共享评估、部署事件规范、验证研发资助、全球南方算力接入——≥1 条具约束力执法路径或经验证试点,无需全球训练暂停)。
理由: N9 模态(0.58)= 论坛话语无约束力——反 U6。U6 成功尾部 = N9 分支 T1 部分部署(0.18)、T3 验证限制(0.05),加上印度/UN 包容的正向解读。Anthropic 条件暂停带验证是 U6 成功终点,非当前预期。
证据:
- 乌托邦时间线 §U6
- N9 上级 — 分支 M1/T1/T2/T3
- N3 §17 T2 — 真实条约尾部 0.04–0.08
类比: IAEA 保障——验证不终结全球核电。
什么情况下会改: 验证训练限制条约批准 → U6 与暂停轨道合并;修订节点边界。
置信度: H
2. 分支概览 — @C10 U6 混合
主张:
| 分支 | P | 描述 | N9 镜像 |
|---|---|---|---|
| U6-M(论坛 + 软法) | 0.50 | Bletchley→Seoul→Paris→India→Geneva 延续;AISI 网络;无绑定验证 | N9 M1 0.58 |
| U6-T(部分强制力) | 0.32 | EU GPAI + CoE 条约 + 韩日部署罚款 + 美中护栏 + HEM 试点 | N9 T1 0.18 + 提升 |
| U6-S(强协调) | 0.10 | 验证训练限制或 IAEA 类比含视察权 + Anthropic 暂停激活 | N9 T3 + N3 T2 |
| U6-X(空壳陷阱) | 0.08 | 90+ 签署方,零执法——虚假信心 | N9 T2 0.10 |
理由: U6-T > N9 T1 单独因部署执法已部分 live(EU AI 法案 2025/2026 年 8 月)。U6-S 仍薄尾部。和 ≈1.0。
证据:
- N9 §2 分支概览
- N9 §28 条约复合表
类比: 气候 COP——雄心宣言(M)vs 巴黎协定第 13 条透明(T)vs 绑定总量交易(S,罕见)。
什么情况下会改: Geneva 2027 强制权重审计协议 → U6-S ↑。
置信度: M
3. P = 0.22 — 复合 U6 @C10 “足够有益”
主张: P(至 @C10,5 项中 ≥3:(1) AISI 网络评估共享运行,(2) EU GPAI 执法 ≥2 次行动,(3) 美中护栏轨道含联合标准,(4) UN 科学小组年度周期可信,(5) HEM 或算力 attestation 试点 ≥2 国)= 0.22(区间 0.15–0.30)。
理由: 折扣联合——与 U5 EU/美国国内胜利相关。对 U3 乘数足够有益,非乌托邦。模态 c8 包含子集(EU 执法 + AISI)~0.15–0.18——U6 复合略高于模态治理单独。
证据:
- 组分 §9–§22
c8C6–C8 治理行
类比: WTO TBT——相互承认无关税归零。
什么情况下会改: Phase 3 correlation_matrix_positive.md 细化与 U5 重叠。
置信度: M
4. 交叉引用 c8 — 模态多边 = 话语 + EU 执法,仍无暂停
主张: c8 模态多边姿态:峰会外交继续;EU 部署快于美国;美中护栏话语非条约;P(无暂停) 0.82–0.84 不变。
理由: c8 §Governance 行——“EU GPAI 执法;无训练 FLOP 上限;持久全球暂停 P <2%。” U6-M 即 c8 模态,非乌托邦成功。
证据:
- C8 社会快照 §What “modal” means
- N9 §29 P(无暂停) delta
类比: UNFCCC 进程——数十年 COP,排放继续。
什么情况下会改: c9 乌托邦快照文档按 Ci 量化 U6 提升——在那里校准。
置信度: H
5. Bletchley 2023 — 制度种子(成功基础)
主张: Bletchley 2023 年 11 月建立持久制度词汇(前沿 AI、评估、AISI 网络),P(制度遗产至 2028 年存续)= 0.85。
理由: Seoul、Paris、India、Geneva 均援引 Bletchley 谱系;28 国 → 91 签署方轨迹。成功 = 议程持续即使绑定内容收窄。
证据:
- (内部笔记)
- (内部笔记) §2.8
- UK gov Bletchley communique
类比: 布雷顿森林会议——制度超越初始雄心。
什么情况下会改: 重大峰会明确否定 Bletchley 安全框架 → ↓。
置信度: M–H
6. Seoul 2024 — AISI 网络 + 前沿 AI 安全承诺
主张: P(至 2028 年 ≥8 国经 AISI 网络积极共享前沿评估方法)= 0.72;P(中国签署部长级宣言)= 0.15(低——成功 = 企业智谱式承诺)。
理由: Seoul 产出 AISI 网络(10 国 + EU);部长级 27+EU 无中国预示 Paris 分裂。有益 = 评估共享,非暂停。
证据:
- https://www.gov.uk/government/news/new-commitmentto-deepen-work-on-severe-ai-risks-concludes-ai-seoul-summit
- N9 §5 — 中国跳过部长级;智谱企业签署方
类比: IPCC——科学协调无排放上限。
什么情况下会改: 中国与美国共同签署下届 Seoul 式部长级 → ↑ 0.35+。
置信度: M
7. Paris 2025 — 分裂中的部分成功
主张: Paris AI Action Summit(2025 年 2 月):~60 签署方含中国、印度、阿联酋;美英未签——P(此模式持续至 2028)= 0.70;P(有益结果尽管美国缺席:全球南方议程设定 + 投资承诺)= 0.55。
理由: 美国缺席伤害验证条约;帮助包容/可持续框架使印度/阿联酋与接入非暂停对齐——U6 部分胜利利于 U3 全球南方科学接入。
证据:
- https://www.theguardian.com/technology/2025/feb/11/us-uk-paris-ai-summit-artificial-intelligence-declaration
- https://onu.delegfrance.org/statement-on-inclusive-and-sustainable-artificial-intelligence-for-people-and
- N9 §4
类比: 无美国的京都——机制继续,更弱非空。
什么情况下会改: 特朗普第二任期美国签署含验证附件的继任文件 → 分支打破。
置信度: M–H
8. India AI Impact 2026 — 新德里宣言(91 签署方)
主张: P(新德里宣言至 2028 年 ≥100 后续签署方,含运行中算力接入或主权 AI 承诺)= 0.60;P(反冻结框架持续)= 0.85。
理由: 2026 年 2 月 88→91 签署方;美中均签;“AI for All”/主权 AI——有益于包容,敌对于暂停。U6 成功重定义为接入 + 标准,非停摆。
证据:
类比: 1970 年代 NIEO 技术转移修辞——部分真实基建(India Stack),非能力约束。
什么情况下会改: 宣言修订含可验证算力上限 → 反冻结 ↓;U6-S ↑。
置信度: M–H
9. UN 全球对话 Geneva 2026 年 7 月 — 后续
主张: P(2026 年 7 月 6–7 日 Geneva 会议产出可信路线图至 2027 纽约会议,≥120 国参与)= 0.65;P(强制执法结果)= 0.05。
理由: GDC 授权 = 非监管包容论坛;1,000+ 书面提交;科学小组 7 月 1 日初步报告。成功 = 程序合法性 + 科学输入,非条约。
证据:
- https://www.un.org/global-dialogue-ai-governance/en
- https://www.un.org/en/delegate-delegate-gva-delegate-nyc/inaugural-global-dialogue-ai-governance-convenes-geneva
- N9 §7
类比: WSIS 2003–2005——十年进程,软成果先行。
什么情况下会改: 成果文件含 >10²⁵ FLOP 运行强制国家报告 → U6-T ↑。
置信度: M
10. UN 独立科学小组 — 年度证据周期
主张: P(小组交付 ≥2 份可信年度报告(2026 初步 + 2027 完整),被 ≥50 国 AI 政策采用)= 0.58。
理由: Bengio + Ressa 联席主席;2,600 候选人中 40 专家;2026 年 7 月初步报告警告:保障滞后于能力。有益 = 共享认识论基线——任何验证条约前提。
证据:
- https://www.un.org/independent-international-scientific-panel-ai/en/preliminary-report
- https://webtv.un.org/en/asset/k1v/k1v0ss6l5a — 2026 年 7 月 1 日发布
类比: IPCC——科学协调先于(弱)政策。
什么情况下会改: 小组 2027 报告前解散或政治化 → ↓。
置信度: M
11. P = 0.10 — 空壳条约(危险失败模式)
主张: P(全球签署 AI 文书 ≥80 方,至 2030 无验证/执法机构运行,被实验室引为”治理”)= 0.10——N9 T2 反转为 U6 失败。
理由: Paris + 新德里已匹配画像——广泛签署方、自愿支柱。危险: 虚假信心加速竞赛(N9 p(doom) +0.5–1pp)。U6 须与成功分开追踪。
证据:
- N9 §11 P=0.10
- Hinton Geneva 2026 — 小组 ≠ 限制
类比: 巴黎协定早期 NDC——承诺无强制合规。
什么情况下会改: 签署方资助 IAEA 类比含视察权且美国加入 → 重分类为 U6-S。
置信度: M
12. P = 0.18 — 部分部署标准有真实强制力
主张: P(绑定部署规则——事件报告、文档、市场撤回——无训练上限,全球前沿提供商强制执行)= 0.18——N9 T1 成功尾部。
理由: EU AI 法案已 live;欧洲委员会 CETS 225(2024);UK AISI 评估;韩国 AI 基本法轨迹。18% = 布鲁塞尔效应 + CoE + AISI 网络对齐的复合路径。
证据:
- https://www.coe.int/en/web/artificial-intelligence/the-framework-convention-on-artificial-intelligence
- N9 §12
- EU 执法 2026 年 8 月
类比: 巴塞尔 III——重报告,无禁银行。
什么情况下会改: 美国联邦法优先于域外 EU 义务 → ↓;韩国罚款美国前沿实验室 → ↑。
置信度: M
13. P = 0.05 — 2030 年前验证训练限制条约
主张: P(双边或多边训练 FLOP 上限 + 验证条约至 2030)= 0.05(区间 0.03–0.08)——N9 §13 / N3 T2。
理由: HEM 不成熟;美中议程不匹配;印度反冻结。5% = 极端尾部——U6-S 核心。需危机 + 验证突破。
证据:
- N9 §13;N3 §17 T2
- arxiv 2604.04712 — 条约级计量不成熟(节点 4 §19)
类比: INF 条约 1987——均势 + 验证技术 + 政治窗口。
什么情况下会改: 美中护栏发布试点 HEM 及公开结果 → ↑ 至 0.10–0.15。
置信度: M–H
14. IAEA / NPT 类比 — 可行性评估
主张: P(IAEA 类比 AI 机构含训练集群视察权,至 2030 资助并章程化)= 0.08;P(完整运行验证)= 0.03。
理由: NPT 成功于裂变材料瓶颈点 + 地缘政治窗口;AI 缺 (1) 公认危险材料,(2) 美中均势交易,(3) HEM 成熟度。类比告知 U6-S 形态,非基率。
证据:
- N9 §IAEA 参考;
research_international_ai_governance_platforms.md - N3 §21 — 权重验证不成熟
- Hinton / Global Call for AI Red Lines 2026 — 愿景性
类比: IAEA 1957——广岛数年后 + 艾森豪威尔 Atoms for Peace。
什么情况下会改: UN 大会紧急决议创建 AI 验证基金且美中共同赞助 → ↑。
置信度: L
15. P = 0.50 — 美中护栏对话继续(非暂停)
主张: P(正式美中 AI 对话至 2028 年在护栏/滥用上重启并持续)= 0.50;P(相互训练冻结 | 对话) <0.02。
理由: 2026 年 5 月北京峰会重启;Bessent 非国家行为体框架;第二轨道 >8 场 vs 第一轨道 1 场。对话与暂停解耦——中方条件在芯片管制。
证据:
- (内部笔记)
- N9 §14;N3 §20
类比: 美苏热线——危机通讯,非裁军。
什么情况下会改: 第二届 Geneva 会议发布联合安全标准 → U6-T ↑。
置信度: M
16. P = 0.06 — 美中验证研发联合试点(N3 T2 成功切片)
主张: P(美 + 中公开资助或宣布联合 HEM / 算力 attestation 研发试点至 2028)= 0.06——N3 T2 尾部子集。
理由: T2 = 训练限制 + 部分验证;仅试点 = 无上限的 U6-T 胜利。盗窃危机通常加速竞赛(T3 0.15–0.25)多于赋能信任——低基率。
证据:
- N3 §17 T2 P=0.04–0.08
- N3 §21 — 验证缺口
- AI 2027 附录 S — HEM / 算力暂停概念
类比: 1990 年代美俄实验室合作——窄信任建设。
什么情况下会改: Geneva 2026 后双边MOU 算力验证 → ↑ 至 ≥0.12。
置信度: L
17. HEM / 算力计量不成熟 — 绑定约束
主张: P(条约级 HEM 至 2030 运行就绪用于前沿训练验证)= 0.15(区间 0.10–0.22)。
理由: FlexHEG 学术;出口管制 attestation 部分;H100 集群无部署强制远程 attestation。Playbook:3–5 年中期视野。阻塞 U6-S 直至解决。
证据:
- N3 §21;节点 7 §HEM P=0.12 试点
- (内部笔记) — 前提 #4
类比: 核试验探测——数年地震网络建设。
什么情况下会改: 主要云强制政府合同 HEM → ↑。
置信度: M
18. Anthropic 条件暂停带验证 — 正向路径
主张: P(Anthropic 在存在此类协议时 citing 已验证多边协议实际停摆前沿训练 >30 天)= 0.70;P(2030 前存在协议)= 0.06;无条件 P(停摆) ≈ 0.04。
理由: 2026 年 6 月 RSI 政策文章——暂停仅当多边验证存在;尚不存在。正向路径 = U6-S 赋能实验室可信停摆——非当前模态。修辞期待,非承诺。
证据:
- (内部笔记)
- N3 §15 — Anthropic 单边停摆 0.05–0.08
- N9 §2 — Anthropic RSI 2026 年 6 月
类比: 药企试验自愿暂停——FDA + 验证数据存在时真实。
什么情况下会改: ≥2 家实验室 citing 新德里或 Geneva 文书停摆 >90 天 → 条件验证。
置信度: M
19. 全球南方包容 — 118 国缺口
主张: P(至 2028 年 ≥118 个联合国成员国在 AI 治理论坛有意义参与——发言、书面提交、算力接入承诺)= 0.75;P(验证设计绑定声音)= 0.20。
理由: Geneva “每国一席”;印度 91 签署方;全球南方在 Bletchley 部长级核心代表性不足。包容成功 ≠ 暂停——常反冻结。
证据:
- https://www.un.org/global-dialogue-ai-governance/en/faq — 118+ 参与目标
- N9 §6 — 巴基斯坦/台湾不在新德里名单
research_international_ai_governance_platforms.md
类比: WTO 多哈发展回合——包容无权力转移。
什么情况下会改: UN 对话 AI 规则加权投票 → 绑定声音 ↑。
置信度: M
20. 全球南方反冻结联盟 — U6 张力
主张: P(印度领导集团至 2030 阻止任何多边文书中的训练休会语言)= 0.80。
理由: 新德里七脉轮——接入、增长、能源;莫迪总理”Sarvajan Hitaya”;主权 AI 为发展权。有益 U6 须在此约束下运作。
证据:
- N9 §6, §21 — P(反冻结)=0.80
- 节点 4 §27 — DeepSeek → 加速非暂停
类比: G77 气候——共同但有区别的责任。
什么情况下会改: 印度主办暂停峰会联盟 → 证伪。
置信度: M–H
21. P = 0.75 — 英澳 AISI 评估共享(Five Eyes 通道)
主张: P(英澳 2026 年 5 月 MoU 至 2028 年产出 ≥2 份共享机密或双用途前沿评估报告用于政策)= 0.75。
理由: 条约阈值以下具体双边有益协调;AISI rebranding 后网络/国安侧重。U6-T 积木。
证据:
- https://www.gov.uk/government/news/uk-and-australia-pact-on-fast-moving-ai-security-risks — 2026-05-25
- N9 §23
类比: Five Eyes SIGINT 共享——深度合作无公开条约。
什么情况下会改: MoU 从未产出共享公开或泄露评估产品 → ↓。
置信度: M
22. 欧洲委员会 CETS 225 — 条约层
主张: P(至 2028 年 ≥35 方批准 AI 框架公约,对高风险 AI 有可执行人权监督)= 0.45。
理由: 2024 年 9 月开放;首个绑定多边 AI 条约;与 EU 重叠但延伸至英、加等。部署中心——U6-T 兼容。
证据:
类比: 欧洲人权公约——区域绑定层。
什么情况下会改: 美国签署 CETS 225 → ↑ 重大。
置信度: M
23. 韩国 / 日本 / 巴西 — 部署执法波
主张: P(韩国 AI 基本法、日本 AI 推进法、巴西 Marco Legal AI 之一至 2029 年对外国前沿提供商罚款 ≥$1M)= 0.28。
理由: N9 证伪观察清单——韩国罚美国实验室 ↑ T3;日本 MATCH 对齐;巴西众议院投票不确定。复合布鲁塞尔效应。
证据:
- N9 §32 证伪 — 韩国 AI 基本法
- N9 §38–§42 区域行
类比: GDPR 罚美国科技——域外执法。
什么情况下会改: 三者均未颁布 → ↓ 至 <0.12。
置信度: L–M
24. 阿联酋 / 海湾 — 第三极有益协调
主张: P(海湾国家将主权算力 + Paris/新德里承诺协调为全球南方伙伴使用的区域评估中心)= 0.40。
理由: 阿联酋 Paris 签署方;G42 Stargate;MGX/Mistral——有益 = 算力接入 + 标准出口,非暂停。增加全球 FLOPs(竞赛渠道)同时改善本地治理能力。
证据:
- N9 §24 — 阿联酋 P(Paris 签署方)=0.95
- N9 中海湾 AI 政策架构 2026 来源
类比: 新加坡金融枢纽——标准 + 接入。
什么情况下会改: EU 因 GPAI 阻止 G42 出口 → 区域中心 ↓。
置信度: L–M
25. 与 P(无暂停) 的相关 — U6 有益 ≠ 停摆
主张:
| U6 分支 | P(无暂停) 条件 | 相对 0.82 基线 delta |
|---|---|---|
| U6-M 论坛话语 | 0.84 | +0.02(空话) |
| U6-T 部分强制力 | 0.80 | −0.02(仅部署摩擦) |
| U6-S 验证条约 | 0.55–0.65 | −0.17–0.27 |
| U6-X 空壳 | 0.86 | +0.04(虚假信心) |
理由: N9 §29 加权数学;空壳对对齐时间最差。勿边际相乘——情景分支。
证据:
- N9 §29–§30
- 相关簇 A–H — P(无暂停) ↔ 竞赛加速
类比: 贸易协定——更多规则,商业继续。
什么情况下会改: U6-S 实现 → 修订 my pdoom crux #5。
置信度: M
26. U3 乘数 — 国际标准降低科学摩擦
主张: P(U3 科学红利路径 ↑ | U6-T vs U6-M) = 绝对 +0.10–0.15——共享评估 + 事件规范降低跨境研究摩擦和意外市场撤回。
理由: U6 为多司法管辖区部署的生物/材料 AI 工具赋能可复现安全基线。以 U5 国内筛查为条件——相关 ρ≈0.4。
证据:
- 主文档 §U6 — U3 乘数
c8科学瓶颈——试验/GMP 主导;U6 对发现边际
类比: ICH 协调——跨司法管辖区更快药批。
什么情况下会改: U3 科学繁荣 量化联合模型。
置信度: L–M
27. 空壳作虚假安全 — p(doom) 渠道
主张: U6-X 空壳相对反事实 P(至 2050 灭绝) +0.5–1.0pp——政策制定者/实验室引用签署方而竞赛加速。
理由: N9 §30 p(doom) 渠道;Hinton 警告咨询机构。最差 U6 分支对时间——劣于诚实论坛话语(U6-M)。
证据:
- N9 §11, §30
- LessWrong Global Call for AI Red Lines — 愿景性 2026 截止
类比: 马奇诺防线——信心无覆盖。
什么情况下会改: 独立审计显示峰会签署方放缓前沿发布 → 证伪虚假安全论题。
置信度: L–M
28. 若 U6-S 发生会是什么样
主张: U6-S 至 2030 可观察 bundle:(1) 美中批准侧协议含 HEM 试点 + 声明 FLOP 通知,(2) UN 章程验证机构含 ≥3 次视察,(3) Anthropic + ≥1 同行在验证触发后 30 天停摆,(4) 印度不否决——需半导体交易。
理由: 可证伪情景草图——非预测。N3 Slowdown Ending “The Deal” 参考类。
证据:
- N3 §17 T2 描述
- AI 2027 Slowdown Ending 叙事(情景装置)
类比: SALT I——有限、验证、政治附条件。
什么情况下会改: 4 项中任意 2 可观察满足 → U6-S ↑ 至 ≥0.25。
置信度: L
29. P(treaty) 复合 — 纸面 vs 执法(U6 核算)
主张:
| 指标 | P | U6 分类 |
|---|---|---|
| 任意签署文书 ≥60 方 | 0.85 | 已真——单独非成功 |
| 空壳(无验证) | 0.10 | U6-X 失败 |
| 部分部署执法 | 0.18 | U6-T 核心 |
| 验证训练限制 | 0.05 | U6-S 核心 |
| 净有益(U6-T 或更好) | 0.22–0.32 | §3 复合 |
理由: 分离纸面与执法——N9 §28 主更新。
证据:
- N9 §28
类比: 复式记账——毛签署方 vs 净执法。
什么情况下会改: Phase 3 综合与 U5 栈概率合并。
置信度: M
30. 行为体表 — 多边成功菜单
| 行为体 | 有益结果 | P | 置信度 |
|---|---|---|---|
| 美国 | 双边护栏;签署部署标准 | 0.55 / 0.15 | M |
| 中国 | 开放权重外交 + 护栏对话 | 0.70 / 0.50 | M |
| 欧盟 | GPAI 执法 + CoE 对齐 | 0.40 / 0.45 | M |
| 印度 | 主权 AI + 宣言主办 | 0.55 / 0.80 反冻结 | M |
| 英/澳 | AISI 评估共享 | 0.75 | M |
| 联合国 | 科学小组 + 对话路线图 | 0.58 / 0.65 | M |
| 前沿实验室 | 若验证则条件暂停 | 0.04 无条件 | M |
证据: N9 §19–§24 行为体表。
31. 证伪条件(观察清单)
| 观察结果 | 分支 |
|---|---|
| 美中验证训练条约 | U6-S live |
| EU 至 2029 无 GPAI 罚款 | U6-T ↓ |
| ≥2 家实验室 citing 多边协议停摆 >90 天 | P(无暂停) ↓ 重大 |
| 印度暂停联盟 | §20 错误 |
| Geneva 2027 权重审计强制 | U6-S ↑ |
| 100+ 签署方,零执法事件 | U6-X ↑ |
置信度: M
32. 相关文件
更新日志
| 日期 | 变更 |
|---|---|
| 2026-07-04 | 初始研究稿 — 32 节;Bletchley→Geneva 链 + N9/N3 成功尾部 |
| 2026-07-07 | 完整中文翻译 |