← 返回

p(doom) 证据 — 共享骨架(混合时间、C0–C10)

2026年7月5日

证据索引 · English · 主文

每条格式:主张 · 理由 · 证据 · 类比 · 什么情况下会改 · 置信度(高/中/低)。


父文档: 共享时间轴 C0–C10
涵盖: 混合时间规则、能力脊柱 C0–C10 日期、跨节点综合表、共享方法主张
节点专属概率:节点 1 就业节点 4 吹哨


混合时间规则(已锁定:C)

P(method) — 快轨 ≈ AI 2027 / METR 用于能力

主张: 智能体自主性、METR 时间视界翻倍、编程智能体收入、内部 RSI 话语,沿 ~AI 2027 日历 或部分指标更快推进。

理由: AI 2027 Tracker 2026-06:智能体自主性 Confirmed/Ahead;METR TH1.1 自 2024 起翻倍 ~89 天(快于 AI 2027 隐含的全时段 ~131 天)。Claude Code / Opus 4.6 将 AI Futures Model 时间线 提前 1.5–2 年(2026 Q1 更新)。

证据:

类比: 2023–24「去束缚」阶跃(聊天机器人 → 智能体)与 Aschenbrenner OOM 叙事时间吻合。

什么情况下会改: METR 翻倍连续 4 个前沿版本回落至 >180 天 智能体收入停滞 → 慢能力轨降至 0.85× 或更低。

置信度: M–H


P(method) — 慢轨 ≈ 政治/公共显著性 +30%

主张: 大规模就业冲击、DC 抗议、强制筛查 立法、NYT 吹哨人 主流周期,比 AI 2027 戏剧日历滞后能力里程碑约 6–18 个月

理由: Tracker 2026-06:经济就业冲击节点 Behind;治理抗议 Emerging 非 Confirmed;BMIA 2026-01 提出但未成法;Kokotajlo/Saunders 2024 显著性 零暂停 — 政策随联盟缓慢跟进。COVID 西方政策滞后 ~2–3 月 即便对明显尾部风险亦然((内部笔记) 采用此不变量)。

证据:

  • (内部笔记) — 经济部分预测 Behind;治理抗议 Emerging
  • (内部笔记) — FLI 信零效果;SB 1047 否决时间线
  • (内部笔记) — Canaries 微观冲击无宏观崩溃
  • Yale Budget Lab 2026 — ChatGPT 后 33 月无全国 AI 失业尖峰

类比: Y2K 修复在可见危机前数年;蒙特利尔议定书在臭氧洞发现后 ~2–3 年 才签条约。

什么情况下会改: 单一能力头条后 3 月内 联邦训练暂停或 BMIA 签署 → 慢轨压缩至 +10%。

置信度: M


P(method) — 人类行动节点锚定于 Ci 里程碑,非 AI 2027 剧情节拍

主张: Node 3(窃取)锚定 C5+,非 2027-02;Node 4 锚定 C10,非 2027-10 备忘录。

理由: 权重外泄价值随 检查点价值(10²⁷–10²⁸ FLOP 级)缩放;tracker 尚无公开 10²⁸ → C5 偏晚。吹哨人 政策效应 2024 早于 C10 能力 — 我们区分 显著性(早)与 完整 Node 4(C10 + Trigger E)。AI 2027 是情景着色,非预测日历。

证据:

  • (内部笔记) — 窃取节拍是叙事压力测试
  • (内部笔记) §timing
  • (内部笔记) — 2024–26 部分 Node 4
  • (内部笔记) — SL3/SL4 升级滞后于能力

类比: 核试验禁令辩论滞后于弹头 设计 能力;政策锚定于 已部署 系统。

什么情况下会改: 确认 10²⁸ 运行 + 2027 权重窃取企图 → 将 Node 3 前拉至 AI 2027 日历。

置信度: M–H


能力脊柱 C0–C10(tracker 状态主张)

Ci主张(2026-07)理由证据置信度
C0智能体小众 → 主流 ConfirmedOSWorld、编程智能体、METR 小时数上升Tracker 智能体自主性 Confirmed(内部笔记)H
C110²⁸ FLOP 运行 Emerging,未公开Epoch 前沿 ~10²⁶·⁵–10²⁷;无实验室确认 10²⁸(内部笔记) §Epoch;tracker C1 EmergingM–H
C21.5× R&D 乘数 混合内部算法加速真实但难公开验证Tracker 经济/智能体 混合L–M
C3中国 CDZ Emerging地缘政治动员 rhetoric ↑;难验证 CDZ 等价物Tracker 地缘政治 EmergingL–M
C4初级劳动力冲击 部分已发生;抗议 BehindCanaries、Block、Challenger;无 1 万 DC 游行Node 1 理由;tracker 经济部分 BehindM
C5–C10尚不可检验 / Emerging持续学习、neuralese、AGI 宣布、Agent-4 — 无公开确认Tracker Not Yet Testable / EmergingM(对「尚未」)

各 Ci 人类响应节点 时间在能力触发后于节点专属理由文件中推导。


跨节点综合表(模态路径)

阶段:现在 → 2027 Q1(Node 1 部分 + Node 2 内部)

主张: 智能体规模化;初级招聘受损;筛查联盟形成 公开生物恐慌。

理由: Node 1 触发器 已满足(Canaries、Challenger);Node 2 内部显著性 已满足(Amodei 2026-06、screendna、BMIA 提出)。公开 CBRN 显著性仍需 Trigger E(Node 2 理由 §Trigger E)。

证据: 节点 1 就业 触发器;节点 2 生物 内部时间;(内部笔记)

置信度: M–H


阶段:2027 Q2 – 2028(Node 1 峰值 + Node 2 模态)

主张: 劳动力听证 + BMIA/EU 筛查 可能仍无暂停

理由: 模态分支质量在 Node 1(P 听证 0.75)× Node 2(P BMIA 0.45),近似独立 — 不同联盟(劳动力 vs 合成/国安)。二者均反对训练上限(playbook:暂停 <5%)。

证据: 节点 1 就业 模态;节点 2 生物 BMIA §;(内部笔记) §Executive summary

p(doom) 通道: ↓ P(协调暂停);生物尾部 模态 Node 2(筛查)则修剪 — 条件性 非自动

置信度: M


阶段:~2028(Node 3 于 C5+)

主张: 窃取/国安危机;出口管制;竞赛 加速

理由: 模态 Node 3:P(出口扩张 0.70) × P(安全支出 0.75);Anthropic RSI 条件暂停需验证 事件。窃取企图基础率 ~2030 前专家 78%(AI 2027 Security Forecast)但 时间 在 C5+。

证据: 节点 3 盗窃https://ai-2027.com/research/security-forecast;Fable 出口禁令 2026-06

置信度: M


阶段:~2028 Q2–Q3(Node 4 于 C10)

主张: 吹哨人 → 监督非暂停;P(灭绝 | E, 模态) ~12–22%

理由: Node 4 分支(给定 E 模态 0.58)× 节点 4 吹哨 §34–37 条件链的乘积。先前节点提高竞赛速度、降低暂停概率。

证据: 节点 4 吹哨;Saunders 2024、FLI 2023 类比

置信度: L–M(条件链宽)


共享方法主张

P(method) — FLI 暂停信 → 零约束政策

主张: 零成本公开信不推动美国法律。

理由: 2023-03 1000+ 签署人;无暂停、无许可;playbook 记录 零政策效应;Cruz 暂停条款 2025-07 99–1 剥离显示 反监管 底线同样极端但方向相反。

证据: (内部笔记) §2.1;(内部笔记) §2023.03 FLI

置信度: H


P(method) — SB 1047 否决 → SB 53 透明度存活

主张: 行业扼杀 上限报告 随实验室支持存活。

理由: Newsom 2024-09 否决;SB 53 2025-09 签署获 Anthropic/Encode 支持;Wiener/Encode 路径见 (内部笔记)

证据: Playbook §1.2;primer §2.4;节点 1 就业 SB53 0.85

置信度: H


P(method) — 12–18 月监管延迟不变量

主张: 即便显著的 AI 风险也面临 季到年 制度滞后,除非 Trigger E(事件/泄露)。

理由: COVID 2020-01–03;OSTP 50bp 暂停;BMIA 2026-01 送委员会;RAISE 2025-12 签署、2027-01-01 生效 — ~13 月 州例。

证据: Playbook;Node 2 TAIL-B 0.15;Node 4 媒体疲劳

置信度: M


相关

  • README.md — 完整索引
  • 主预测 — 消费分支输出