← 返回

AI 未来证据 — U6:多边有益 AI

2026年7月5日

未来索引 · English · 主预测

每条格式:主张 · 理由 · 证据 · 类比 · 什么情况下会改 · 置信度(高/中/低)。


上级: 乌托邦时间线
镜像(末日失败分支): 节点 9 多边(N9 多边)、节点 3 盗窃(N3 T2 条约 / 美中)
模态基线(非乌托邦): C8 社会快照
日期: 2026-07-04
格式: 主张 | 理由 | 证据 | 类比 | 什么情况下会改 | 置信度

每一节记录 U6 — 多边有益 AI 协调的一条概率:峰会后续、部署标准、验证研发、可信(非空壳)国际 AI 治理。概率为主观判断(subjective elicitation),除非注明源自 N9/N3。

乌托邦桶: U3 乘数——国际标准降低科学红利和制度黄金时代摩擦;直接解锁 U1/U2(无 U1/U5)。


1. 节点定义 — 有益协调 ≠ 暂停

主张: U6 = P(至 @C10,多边 AI 治理产生实质有益成果——共享评估、部署事件规范、验证研发资助、全球南方算力接入——≥1 条具约束力执法路径经验证试点,无需全球训练暂停)。

理由: N9 模态(0.58)= 论坛话语无约束力——反 U6。U6 成功尾部 = N9 分支 T1 部分部署(0.18)、T3 验证限制(0.05),加上印度/UN 包容的正向解读。Anthropic 条件暂停带验证是 U6 成功终点,非当前预期。

证据:

  • 乌托邦时间线 §U6
  • N9 上级 — 分支 M1/T1/T2/T3
  • N3 §17 T2 — 真实条约尾部 0.04–0.08

类比: IAEA 保障——验证终结全球核电。

什么情况下会改: 验证训练限制条约批准 → U6 与暂停轨道合并;修订节点边界。

置信度: H


2. 分支概览 — @C10 U6 混合

主张:

分支P描述N9 镜像
U6-M(论坛 + 软法)0.50Bletchley→Seoul→Paris→India→Geneva 延续;AISI 网络;绑定验证N9 M1 0.58
U6-T(部分强制力)0.32EU GPAI + CoE 条约 + 韩日部署罚款 + 美中护栏 + HEM 试点N9 T1 0.18 + 提升
U6-S(强协调)0.10验证训练限制 IAEA 类比含视察权 + Anthropic 暂停激活N9 T3 + N3 T2
U6-X(空壳陷阱)0.0890+ 签署方,零执法——虚假信心N9 T2 0.10

理由: U6-T > N9 T1 单独因部署执法已部分 live(EU AI 法案 2025/2026 年 8 月)。U6-S 仍薄尾部。和 ≈1.0。

证据:

  • N9 §2 分支概览
  • N9 §28 条约复合表

类比: 气候 COP——雄心宣言(M)vs 巴黎协定第 13 条透明(T)vs 绑定总量交易(S,罕见)。

什么情况下会改: Geneva 2027 强制权重审计协议 → U6-S

置信度: M


3. P = 0.22 — 复合 U6 @C10 “足够有益”

主张: P(至 @C10,5 项中 ≥3:(1) AISI 网络评估共享运行,(2) EU GPAI 执法 ≥2 次行动,(3) 美中护栏轨道含联合标准,(4) UN 科学小组年度周期可信,(5) HEM 或算力 attestation 试点 ≥2 国)= 0.22(区间 0.15–0.30)。

理由: 折扣联合——与 U5 EU/美国国内胜利相关。对 U3 乘数足够有益,非乌托邦。模态 c8 包含子集(EU 执法 + AISI)~0.15–0.18——U6 复合略高于模态治理单独。

证据:

  • 组分 §9–§22
  • c8 C6–C8 治理行

类比: WTO TBT——相互承认无关税归零。

什么情况下会改: Phase 3 correlation_matrix_positive.md 细化与 U5 重叠。

置信度: M


4. 交叉引用 c8 — 模态多边 = 话语 + EU 执法,仍无暂停

主张: c8 模态多边姿态:峰会外交继续;EU 部署快于美国;美中护栏话语非条约;P(无暂停) 0.82–0.84 不变。

理由: c8 §Governance 行——“EU GPAI 执法;训练 FLOP 上限;持久全球暂停 P <2%。” U6-M c8 模态,非乌托邦成功。

证据:

类比: UNFCCC 进程——数十年 COP,排放继续。

什么情况下会改: c9 乌托邦快照文档按 Ci 量化 U6 提升——在那里校准。

置信度: H


5. Bletchley 2023 — 制度种子(成功基础)

主张: Bletchley 2023 年 11 月建立持久制度词汇(前沿 AI、评估、AISI 网络),P(制度遗产至 2028 年存续)= 0.85

理由: Seoul、Paris、India、Geneva 均援引 Bletchley 谱系;28 国 → 91 签署方轨迹。成功 = 议程持续即使绑定内容收窄。

证据:

  • (内部笔记)
  • (内部笔记) §2.8
  • UK gov Bletchley communique

类比: 布雷顿森林会议——制度超越初始雄心。

什么情况下会改: 重大峰会明确否定 Bletchley 安全框架 →

置信度: M–H


6. Seoul 2024 — AISI 网络 + 前沿 AI 安全承诺

主张: P(至 2028 年 ≥8 国经 AISI 网络积极共享前沿评估方法)= 0.72;P(中国签署部长级宣言)= 0.15(低——成功 = 企业智谱式承诺)。

理由: Seoul 产出 AISI 网络(10 国 + EU);部长级 27+EU 无中国预示 Paris 分裂。有益 = 评估共享,非暂停。

证据:

类比: IPCC——科学协调无排放上限。

什么情况下会改: 中国与美国共同签署下届 Seoul 式部长级 → 0.35+。

置信度: M


7. Paris 2025 — 分裂中的部分成功

主张: Paris AI Action Summit(2025 年 2 月):~60 签署方含中国、印度、阿联酋;美英未签——P(此模式持续至 2028)= 0.70;P(有益结果尽管美国缺席:全球南方议程设定 + 投资承诺)= 0.55

理由: 美国缺席伤害验证条约;帮助包容/可持续框架使印度/阿联酋与接入非暂停对齐——U6 部分胜利利于 U3 全球南方科学接入。

证据:

类比: 无美国的京都——机制继续,更弱非空。

什么情况下会改: 特朗普第二任期美国签署含验证附件的继任文件 → 分支打破。

置信度: M–H


8. India AI Impact 2026 — 新德里宣言(91 签署方)

主张: P(新德里宣言至 2028 年 ≥100 后续签署方,含运行中算力接入或主权 AI 承诺)= 0.60;P(反冻结框架持续)= 0.85

理由: 2026 年 2 月 88→91 签署方;美均签;“AI for All”/主权 AI——有益于包容,敌对于暂停。U6 成功重定义接入 + 标准,非停摆。

证据:

类比: 1970 年代 NIEO 技术转移修辞——部分真实基建(India Stack),非能力约束。

什么情况下会改: 宣言修订含可验证算力上限 → 反冻结 ;U6-S

置信度: M–H


9. UN 全球对话 Geneva 2026 年 7 月 — 后续

主张: P(2026 年 7 月 6–7 日 Geneva 会议产出可信路线图至 2027 纽约会议,≥120 国参与)= 0.65;P(强制执法结果)= 0.05

理由: GDC 授权 = 非监管包容论坛;1,000+ 书面提交;科学小组 7 月 1 日初步报告。成功 = 程序合法性 + 科学输入,非条约。

证据:

类比: WSIS 2003–2005——十年进程,软成果先行。

什么情况下会改: 成果文件含 >10²⁵ FLOP 运行强制国家报告 → U6-T

置信度: M


10. UN 独立科学小组 — 年度证据周期

主张: P(小组交付 ≥2 份可信年度报告(2026 初步 + 2027 完整),被 ≥50 国 AI 政策采用)= 0.58

理由: Bengio + Ressa 联席主席;2,600 候选人中 40 专家;2026 年 7 月初步报告警告:保障滞后于能力。有益 = 共享认识论基线——任何验证条约前提。

证据:

类比: IPCC——科学协调先于(弱)政策。

什么情况下会改: 小组 2027 报告前解散或政治化 →

置信度: M


11. P = 0.10 — 空壳条约(危险失败模式)

主张: P(全球签署 AI 文书 ≥80 方,至 2030 验证/执法机构运行,被实验室引为”治理”)= 0.10——N9 T2 反转为 U6 失败

理由: Paris + 新德里已匹配画像——广泛签署方、自愿支柱。危险: 虚假信心加速竞赛(N9 p(doom) +0.5–1pp)。U6 与成功分开追踪。

证据:

类比: 巴黎协定早期 NDC——承诺无强制合规。

什么情况下会改: 签署方资助 IAEA 类比含视察权美国加入 → 重分类为 U6-S。

置信度: M


12. P = 0.18 — 部分部署标准有真实强制力

主张: P(绑定部署规则——事件报告、文档、市场撤回——训练上限,全球前沿提供商强制执行)= 0.18——N9 T1 成功尾部。

理由: EU AI 法案已 live;欧洲委员会 CETS 225(2024);UK AISI 评估;韩国 AI 基本法轨迹。18% = 布鲁塞尔效应 + CoE + AISI 网络对齐的复合路径。

证据:

类比: 巴塞尔 III——重报告,无禁银行。

什么情况下会改: 美国联邦法优先于域外 EU 义务 → ;韩国罚款美国前沿实验室 →

置信度: M


13. P = 0.05 — 2030 年前验证训练限制条约

主张: P(双边或多边训练 FLOP 上限 + 验证条约至 2030)= 0.05(区间 0.03–0.08)——N9 §13 / N3 T2。

理由: HEM 不成熟;美中议程不匹配;印度反冻结。5% = 极端尾部——U6-S 核心。需危机 + 验证突破。

证据:

  • N9 §13;N3 §17 T2
  • arxiv 2604.04712 — 条约级计量不成熟(节点 4 §19)

类比: INF 条约 1987——均势 + 验证技术 + 政治窗口。

什么情况下会改: 美中护栏发布试点 HEM 及公开结果 → 至 0.10–0.15。

置信度: M–H


14. IAEA / NPT 类比 — 可行性评估

主张: P(IAEA 类比 AI 机构含训练集群视察权,至 2030 资助并章程化)= 0.08;P(完整运行验证)= 0.03

理由: NPT 成功于裂变材料瓶颈点 + 地缘政治窗口;AI 缺 (1) 公认危险材料,(2) 美中均势交易,(3) HEM 成熟度。类比告知 U6-S 形态,非基率。

证据:

  • N9 §IAEA 参考;research_international_ai_governance_platforms.md
  • N3 §21 — 权重验证不成熟
  • Hinton / Global Call for AI Red Lines 2026 — 愿景性

类比: IAEA 1957——广岛数年后 + 艾森豪威尔 Atoms for Peace。

什么情况下会改: UN 大会紧急决议创建 AI 验证基金且美中共同赞助 →

置信度: L


15. P = 0.50 — 美中护栏对话继续(非暂停)

主张: P(正式美中 AI 对话至 2028 年在护栏/滥用上重启并持续)= 0.50;P(相互训练冻结 | 对话) <0.02

理由: 2026 年 5 月北京峰会重启;Bessent 非国家行为体框架;第二轨道 >8 场 vs 第一轨道 1 场。对话与暂停解耦——中方条件在芯片管制。

证据:

  • (内部笔记)
  • N9 §14;N3 §20

类比: 美苏热线——危机通讯,非裁军。

什么情况下会改: 第二届 Geneva 会议发布联合安全标准 → U6-T

置信度: M


16. P = 0.06 — 美中验证研发联合试点(N3 T2 成功切片)

主张: P(美 + 中公开资助或宣布联合 HEM / 算力 attestation 研发试点至 2028)= 0.06——N3 T2 尾部子集。

理由: T2 = 训练限制 + 部分验证;仅试点 = 无上限的 U6-T 胜利。盗窃危机通常加速竞赛(T3 0.15–0.25)多于赋能信任——低基率。

证据:

  • N3 §17 T2 P=0.04–0.08
  • N3 §21 — 验证缺口
  • AI 2027 附录 S — HEM / 算力暂停概念

类比: 1990 年代美俄实验室合作——窄信任建设。

什么情况下会改: Geneva 2026 后双边MOU 算力验证 → 至 ≥0.12。

置信度: L


17. HEM / 算力计量不成熟 — 绑定约束

主张: P(条约级 HEM 至 2030 运行就绪用于前沿训练验证)= 0.15(区间 0.10–0.22)。

理由: FlexHEG 学术;出口管制 attestation 部分;H100 集群部署强制远程 attestation。Playbook:3–5 年中期视野。阻塞 U6-S 直至解决。

证据:

  • N3 §21;节点 7 §HEM P=0.12 试点
  • (内部笔记) — 前提 #4

类比: 核试验探测——数年地震网络建设。

什么情况下会改: 主要云强制政府合同 HEM →

置信度: M


18. Anthropic 条件暂停带验证 — 正向路径

主张: P(Anthropic 在存在此类协议时 citing 已验证多边协议实际停摆前沿训练 >30 天)= 0.70;P(2030 前存在协议)= 0.06无条件 P(停摆) ≈ 0.04

理由: 2026 年 6 月 RSI 政策文章——暂停仅当多边验证存在;尚不存在。正向路径 = U6-S 赋能实验室可信停摆——当前模态。修辞期待,非承诺

证据:

  • (内部笔记)
  • N3 §15 — Anthropic 单边停摆 0.05–0.08
  • N9 §2 — Anthropic RSI 2026 年 6 月

类比: 药企试验自愿暂停——FDA + 验证数据存在时真实。

什么情况下会改: ≥2 家实验室 citing 新德里或 Geneva 文书停摆 >90 天 → 条件验证

置信度: M


19. 全球南方包容 — 118 国缺口

主张: P(至 2028 年 ≥118 个联合国成员国在 AI 治理论坛有意义参与——发言、书面提交、算力接入承诺)= 0.75;P(验证设计绑定声音)= 0.20

理由: Geneva “每国一席”;印度 91 签署方;全球南方在 Bletchley 部长级核心代表性不足包容成功暂停——常反冻结

证据:

类比: WTO 多哈发展回合——包容无权力转移。

什么情况下会改: UN 对话 AI 规则加权投票 → 绑定声音

置信度: M


20. 全球南方反冻结联盟 — U6 张力

主张: P(印度领导集团至 2030 阻止任何多边文书中的训练休会语言)= 0.80

理由: 新德里七脉轮——接入、增长、能源;莫迪总理”Sarvajan Hitaya”;主权 AI 为发展权有益 U6此约束下运作。

证据:

  • N9 §6, §21 — P(反冻结)=0.80
  • 节点 4 §27 — DeepSeek → 加速非暂停

类比: G77 气候——共同但有区别的责任。

什么情况下会改: 印度主办暂停峰会联盟 → 证伪。

置信度: M–H


21. P = 0.75 — 英澳 AISI 评估共享(Five Eyes 通道)

主张: P(英澳 2026 年 5 月 MoU 至 2028 年产出 ≥2 份共享机密或双用途前沿评估报告用于政策)= 0.75

理由: 条约阈值以下具体双边有益协调;AISI rebranding 后网络/国安侧重。U6-T 积木。

证据:

类比: Five Eyes SIGINT 共享——深度合作无公开条约。

什么情况下会改: MoU 从未产出共享公开或泄露评估产品 →

置信度: M


22. 欧洲委员会 CETS 225 — 条约层

主张: P(至 2028 年 ≥35 方批准 AI 框架公约,对高风险 AI 有可执行人权监督)= 0.45

理由: 2024 年 9 月开放;首个绑定多边 AI 条约;与 EU 重叠但延伸至英、加等。部署中心——U6-T 兼容。

证据:

类比: 欧洲人权公约——区域绑定层。

什么情况下会改: 美国签署 CETS 225 → 重大。

置信度: M


23. 韩国 / 日本 / 巴西 — 部署执法波

主张: P(韩国 AI 基本法、日本 AI 推进法、巴西 Marco Legal AI 之一至 2029 年对外国前沿提供商罚款 ≥$1M)= 0.28

理由: N9 证伪观察清单——韩国罚美国实验室 T3;日本 MATCH 对齐;巴西众议院投票不确定。复合布鲁塞尔效应。

证据:

  • N9 §32 证伪 — 韩国 AI 基本法
  • N9 §38–§42 区域行

类比: GDPR 罚美国科技——域外执法。

什么情况下会改: 三者未颁布 → 至 <0.12。

置信度: L–M


24. 阿联酋 / 海湾 — 第三极有益协调

主张: P(海湾国家将主权算力 + Paris/新德里承诺协调为全球南方伙伴使用的区域评估中心)= 0.40

理由: 阿联酋 Paris 签署方;G42 Stargate;MGX/Mistral——有益 = 算力接入 + 标准出口,暂停。增加全球 FLOPs(竞赛渠道)同时改善本地治理能力。

证据:

  • N9 §24 — 阿联酋 P(Paris 签署方)=0.95
  • N9 中海湾 AI 政策架构 2026 来源

类比: 新加坡金融枢纽——标准 + 接入。

什么情况下会改: EU 因 GPAI 阻止 G42 出口 → 区域中心

置信度: L–M


25. 与 P(无暂停) 的相关 — U6 有益 ≠ 停摆

主张:

U6 分支P(无暂停) 条件相对 0.82 基线 delta
U6-M 论坛话语0.84+0.02(空话)
U6-T 部分强制力0.80−0.02(仅部署摩擦)
U6-S 验证条约0.55–0.65−0.17–0.27
U6-X 空壳0.86+0.04(虚假信心)

理由: N9 §29 加权数学;空壳对对齐时间最差边际相乘——情景分支。

证据:

类比: 贸易协定——更多规则,商业继续。

什么情况下会改: U6-S 实现 → 修订 my pdoom crux #5。

置信度: M


26. U3 乘数 — 国际标准降低科学摩擦

主张: P(U3 科学红利路径 | U6-T vs U6-M) = 绝对 +0.10–0.15——共享评估 + 事件规范降低跨境研究摩擦和意外市场撤回。

理由: U6 为多司法管辖区部署的生物/材料 AI 工具赋能可复现安全基线。以 U5 国内筛查为条件——相关 ρ≈0.4。

证据:

  • 主文档 §U6 — U3 乘数
  • c8 科学瓶颈——试验/GMP 主导;U6 对发现边际

类比: ICH 协调——跨司法管辖区更快药批。

什么情况下会改: U3 科学繁荣 量化联合模型。

置信度: L–M


27. 空壳作虚假安全 — p(doom) 渠道

主张: U6-X 空壳相对反事实 P(至 2050 灭绝) +0.5–1.0pp——政策制定者/实验室引用签署方而竞赛加速

理由: N9 §30 p(doom) 渠道;Hinton 警告咨询机构。最差 U6 分支对时间——劣于诚实论坛话语(U6-M)。

证据:

  • N9 §11, §30
  • LessWrong Global Call for AI Red Lines — 愿景性 2026 截止

类比: 马奇诺防线——信心无覆盖。

什么情况下会改: 独立审计显示峰会签署方放缓前沿发布 → 证伪虚假安全论题。

置信度: L–M


28. 若 U6-S 发生会是什么样

主张: U6-S 至 2030 可观察 bundle:(1) 美中批准侧协议含 HEM 试点 + 声明 FLOP 通知,(2) UN 章程验证机构含 ≥3 次视察,(3) Anthropic + ≥1 同行在验证触发后 30 天停摆,(4) 印度否决——需半导体交易

理由: 可证伪情景草图——非预测。N3 Slowdown Ending “The Deal” 参考类。

证据:

  • N3 §17 T2 描述
  • AI 2027 Slowdown Ending 叙事(情景装置)

类比: SALT I——有限、验证、政治附条件。

什么情况下会改: 4 项中任意 2 可观察满足 → U6-S 至 ≥0.25。

置信度: L


29. P(treaty) 复合 — 纸面 vs 执法(U6 核算)

主张:

指标PU6 分类
任意签署文书 ≥60 方0.85已真——单独非成功
空壳(无验证)0.10U6-X 失败
部分部署执法0.18U6-T 核心
验证训练限制0.05U6-S 核心
净有益(U6-T 或更好)0.22–0.32§3 复合

理由: 分离纸面执法——N9 §28 主更新。

证据:

  • N9 §28

类比: 复式记账——毛签署方 vs 净执法。

什么情况下会改: Phase 3 综合与 U5 栈概率合并。

置信度: M


30. 行为体表 — 多边成功菜单

行为体有益结果P置信度
美国双边护栏;签署部署标准0.55 / 0.15M
中国开放权重外交 + 护栏对话0.70 / 0.50M
欧盟GPAI 执法 + CoE 对齐0.40 / 0.45M
印度主权 AI + 宣言主办0.55 / 0.80 反冻结M
英/澳AISI 评估共享0.75M
联合国科学小组 + 对话路线图0.58 / 0.65M
前沿实验室若验证则条件暂停0.04 无条件M

证据: N9 §19–§24 行为体表。


31. 证伪条件(观察清单)

观察结果分支
美中验证训练条约U6-S live
EU 至 2029 GPAI 罚款U6-T
≥2 家实验室 citing 多边协议停摆 >90 天P(无暂停) 重大
印度暂停联盟§20 错误
Geneva 2027 权重审计强制U6-S
100+ 签署方,零执法事件U6-X

置信度: M


32. 相关文件


更新日志

日期变更
2026-07-04初始研究稿 — 32 节;Bletchley→Geneva 链 + N9/N3 成功尾部
2026-07-07完整中文翻译