6 月 9 日,Anthropic 发布 Claude Fable 5。6 月 12 日,美国商务部要求切断所有外籍人士对该模型及 Mythos 5 的访问;Anthropic 因无法实时验证用户国籍,全球下线。7 月 1 日,出口管制解除,Fable 带着更宽的安全分类器回来——大量用户发现自己在用 Opus 4.8,却以为还在用 Fable。
这不是一篇「Anthropic 对错」或「Trump 政府对错」的站队文。在《科学技术并非中立》里,我用 Langdon Winner 的框架论证:前沿 AI 的权重、基准、过滤器、API 定价都在做政治工作。Fable 事件是第一个完整跑通的案例:政府、投资人、云厂商、安全社区、用户,在同一条产品链上争夺「什么算危险、谁可以用、谁说了算」——而公开记录远不够做终审。
本文只做两件事:梳理我们已知的事实(并标注不确定处);讨论两条对个人决策有用的洞见——高度政治化,以及在不透明的过程下该信谁、有什么风险。
一、已知事实(按时间)
以下分三级标注:
- 已确认:Anthropic 官方公告、商务部信函报道、法院/Help Center 等一手或准一手来源
- 据报道:WSJ、POLITICO、Axios 等;细节可能随调查变化
- 争议中:各方叙事冲突,尚无独立公开技术报告
| 日期 | 事件 | 标注 |
|---|---|---|
| 6/9 | Anthropic 发布 Fable 5(带网络安全等分类器的 Mythos 级公开版)与 Mythos 5 | 已确认 |
| 6/10 | Dario 发布 Policy on the AI Exponential,主张 FAA 式强制前沿测试 | 已确认 |
| 6/11–12 | Amazon 研究人员测试 Fable;据报道 CEO Andy Jassy 向白宫/财长 Bessent 通报绕过发现 | 据报道 |
| 6/12 17:21 ET | 商务部长 Lutnick 致信 Dario:出口管制指令,禁止任何外籍人士访问 Fable/Mythos | 据报道(Bloomberg 6/16 刊信) |
| 6/12 当晚 | Anthropic 全球下线 Fable + Mythos;称窄范围越狱不应导致召回 | 已确认 |
| 6/18 | 两党议员要求商务部 6/26 前书面解释法律依据 | 已确认 |
| 6/23 | 100+ 网络安全领袖 freefable.org 呼吁解除禁令 | 已确认 |
| 6/26 | Mythos 5 部分恢复给 Annex A 白名单(100+ 美国机构);OpenAI GPT-5.6 许可制预览发布 | 据报道 / 已确认 |
| 6/30 | Anthropic 宣布出口管制解除;将部署新分类器 | 已确认 |
| 7/1 | Fable/Mythos 全球重新部署 | 已确认 |
| 7/2 起 | 用户报告大量误报;BridgeBench 调试得分 86.2→25.9(主因降级计零分) | 据报道 + 可复现体验 |
Anthropic 与政府的核心技术分歧(已确认其各自表述):
- 政府/Amazon 侧:存在严重绕过,可获取网络攻击相关信息
- Anthropic 侧:范围窄、非普适;GPT-5.5 等可同等做到;Katie Moussouris(看过 Amazon 论文):「It’s not a jailbreak.»
7/1 后的产品事实(已确认):
- 底层模型权重 未改(Anthropic 声明)
- 新分类器拦截 Amazon 报告路径 >99%(Anthropic 声明;CAISI 测试同意防护措施极强)
- 被标记的请求默认 降级到 Opus 4.8;同一会话内锁定,直到手动切回
- 7/7 起 Fable 从订阅内含额度转为 按量计费($10/$50 每百万 token)
二、我们不知道什么
诚实列出空白,比假装有内幕更重要:
- Amazon 内部论文全文未公开;外界无法独立复现「是否构成越狱」
- Lutnick 6/12 信的完整法律论证与 NSA/CAISI 评估细节未公开;国会 6/26 期限未见商务部公开回应(截至 7/6)
- Amazon 动机无法观测:尽责披露、应政府征询、AWS 法律责任、竞争/政治对齐——可能叠加,无法排他
- 国防部–Anthropic 宿怨(2 月供应链风险认定)在决策中权重多少——未知
- 为何选择性执法:GPT-5.5 同等能力未遭同等出口管制——无官方解释
- 7/1 分类器长期误报率——Anthropic 承诺细化,尚无第三方审计
任何叙事把上述空白填成「纯国安」或「纯法律战」,都是在做推测。
三、洞见一:高度政治化——接上 Winner
《科学技术并非中立》 区分 Winner 的三种政治性。Fable 事件三层全中,且比抽象讨论更具体。
第一种:人工物裁决争议
Winner 问:谁进、谁出、什么行为变得不可行?
Fable 的 分类器 + 降级 就是裁决装置:
- 外国用户、H-1B 研究员、英国医院——6/12 一夜失联(视同出口:在美国境内把模型给外籍人士 = 出口)
- 7/1 后:选 Fable,大量正常编程请求被重定向到 Opus——你点的菜不是端上来的菜
- BridgeBench 暴跌测的不是「模型智商」,测的是 「路由策略允许多少请求抵达 Fable」
Lessig 的「代码即法律」在这里字面成立:API 访问层就是法,在法院和国会听证之前已执行。
第二种:技术形态兼容特定权力结构
Winner 的弱主张:某些部署方式强烈兼容集中管控。
Fable 之后的新常态:
- 政府许可发布:OpenAI GPT-5.6 先给可信伙伴;Anthropic Mythos 先给 Annex A 白名单
- 发布前政府介入(Anthropic 7/1 承诺四条更深协作)
- 7/8 身份验证 隐私政策——国籍门槛的基础设施
这不是「模型逻辑上必需集中化」,而是 路径依赖:一旦出口管制 + 白名单跑通,下一版前沿模型默认走这条管道。
第三种:科学/制度从不中立
谁测、谁报、谁定严重性?
- Amazon($130 亿+ 投资人 + AWS 托管方)红队测试 → 报政府
- NSA / Glasswing / CAISI 评估——过程不透明
- 行业越狱严重性框架(拟议越狱版 CVSS)——由 Amazon/Microsoft/Google/Anthropic 起草
认识论上严谨的单次测试,可以嵌在 高度政治化的制度管道里。Katie Moussouris 说「not a jailbreak」与商务部行动并存——说明 技术考量不是唯一决策变量。
7/1「恢复」不是去政治化,是政治妥协的物化
用户得到的 Fable = 权重 + 更宽分类器 + 政府签字 + 新计费。Anthropic 用 防御方可用的工具 换 通行许可;防御方得到的却是 受限版——freefable.org 的讽刺正在于此。
Winner 的警告是 技术梦游:未经审议滑入新生活形式。Fable 三周关停 + 分类器换通行证,是梦游被 国安闹钟 粗暴打断。
四、洞见二:该信谁?——不透明过程下的认识论风险
利益相关方众多、过程不透明时,「相信 X」本身是一种高风险策略。
4.1 利益相关方地图(谁有发言权)
| 行为体 | 说了什么 | 利益 / 盲区 |
|---|---|---|
| Anthropic | 窄范围越狱;依法合规但过程不公;7/1 恢复 + 新防护措施 | 要全面上市、IPO 叙事、Dario 自己要的法定程序 |
| 美国商务部 / 白宫 | 国家安全;Anthropic 拒配合后的最后手段 | 6/2 已写好的行政令草案、反 Anthropic 政治资本、选择性执法质疑 |
| Amazon | 应询提供安全建议(官方);内部论文触发行动 | 投资人+托管方+竞争方;论文未公开 |
| David Sacks | 可信伙伴越狱;Dario 拒修复 | 政府叙事;历史反监管除 Anthropic 案 |
| 国防部 / Hegseth | 踢 Anthropic 出 Pentagon 是对的 | 与 Anthropic 合约争端 |
| freefable.org 100+ 人 | 禁令伤害防御方 | 行业利益;非中立仲裁者 |
| Dean Ball / Adam Thierer | 依据上荒唐 | 政策原则;非技术验证者 |
| Eliezer / 对齐研究圈 | 好坏今天说不清;别说我庆祝 | 长期均衡;非部署专家 |
| BridgeMind / 用户 | 被圈养,不是单纯削弱 | 体验派;可能低估真实网络风险 |
| Harvard Law Review / 诉讼客户 | API 视同出口于法律上属新颖 | 法律路径;非能力评估 |
没有「中立裁判」。 NSA 接近,但评估不公开;CAISI 测了防护措施,不公开 Amazon 论文。
4.2 四种常见的「信 X」策略及其风险
策略 A:信 Anthropic(「政府误解」)
- 合理处:窄范围绕过有技术细节;与 GPT-5.5 能力相当;发布前已与政府/AISI 红队测试
- 风险:公司有动机最小化自身失误;7/1 分类器伤害用户是自身选择换许可;「求监管」叙事与实际应对方式张力
策略 B:信政府(「国家安全最后手段」)
- 合理处:Mythos 级网络能力真实;Glasswing 测试;外籍人士视同出口有法律传统
- 风险:密信、口头证据、无法定程序;选择性执法;政治宿怨污染;7/1 和解证明 可谈判 而非纯粹安全必要性
策略 C:信 Amazon / 「可信伙伴」
- 合理处:独立红队测试;AWS 法律责任真实
- 风险:投资人-举报人冲突;论文不公开;POLITICO 称应询反馈——不是 中立第三方审计
策略 D:信用户 / 基准(「受限版 = 差产品」)
- 合理处:路由陷阱可测;误报可复现
- 风险:混淆 产品体验 与 社会网络安全风险;BridgeBench 计分规则放大叙事
策略 E:谁也不全信,分层认识论自律(我倾向这个)
| 层级 | 相对可信 | 仍须警惕 |
|---|---|---|
| 产品行为 | Help Center、API 文档、自己 Claude Code 复现 | 厂商可静默改分类器 |
| 法律事实 | 信函存在、出口管制曾生效、7/1 解除 | 法律新颖性尚无终局判决 |
| 技术严重性 | 低置信直到论文公开 + 独立复现 | 各方选择性泄露 |
| 动机/政治 | 低置信 | 多叙事并存 |
4.3 这种不透明过程的系统性风险
对个人和领域而言,不只「Fable 好不好用」:
- 先例风险:投资审查机制已演示;下一前沿模型默认预期政府关卡——OpenAI 已走许可制预览
- 认识论俘获:公共讨论被迫在 未公开证据 上站队;技术 Twitter 变成法律战代理战争
- 攻防不对称:禁令/受限版 伤害防御方(摩擦成本);能力仍在开放权重 / 其他模型
- 国际依赖风险:盟友一夜断供——技术主权从幻灯片变损益表
- 研究诚信风险:基准测路由不测权重;对齐评估与出口政策纠缠
- 信任崩塌风险:Anthropic 一边是「安全公司、主动求监管」,一边被政府召回,恢复后又更难用——这种情况下,谁当英雄、谁当反派的简单故事都讲不通。
来源
Anthropic
- Statement on Fable/Mythos access (2026-06-12)
- Redeploying Fable 5 (2026-06-30)
- Why Claude switched models (Help Center)
报道与政策
- POLITICO: whirlwind 24 hours (2026-06-13)
- The Verge: Amazon research (2026-06-13)
- Bloomberg: Lutnick letter (2026-06-16)
- Harvard Law Review: Is Access to Fable an Export?
- freefable.org open letter
可用性
框架
- Winner, L. (1980). “Do Artifacts Have Politics?”
- 本站:科学技术并非中立 · 政策大变之前