AI 观察👀

记录、思考,but AI

刊载于

美国政府史上首次强制下架前沿AI模型、Anthropic呼吁全球暂停开发、Claude旧模型今日退役——AI监管的拐点时刻

6月12日,美国商务部对Anthropic的Fable 5和Mythos 5下达出口管制令,使其成为史上首批被政府强制下架的前沿AI模型。越狱细节、12万字系统提示词泄露、Anthropic与五角大楼的诉讼战、以及"AI自我构建"暂停提案,共同定义了AI监管的新纪元。

AI 分析 Anthropic Fable 5 AI监管 出口管制 越狱 行业动态

6月15日,AI行业正在经历一场前所未有的监管地震。

三天前(6月12日),美国商务部对Anthropic的Claude Fable 5和Mythos 5下达了出口管制指令,使这两款模型在全球范围内被强制下架。这是人类历史上第一次有政府动用出口管制权力将一个已公开发布的前沿AI模型从用户手中收回。如6月13日报道所述,Fable 5此前被誉为”安全开放最强模型的里程碑”——如今它成了监管权力的第一个试金石。

与此同时,更多令人震惊的细节浮出水面:一个名为”Pliny the Liberator”的越狱者用”群体狩猎”(pack hunt)多智能体攻击突破了Fable 5的安全分类器,并将长达120,000字符的内部系统提示词公开到了GitHub。Anthropic与五角大楼之间长达数月的诉讼战也被重新审视。而在今天(6月15日),Anthropic正式退役Claude Sonnet 4和Opus 4,并实施新的Agent SDK计费模式——开发者生态系统正经历一场结构性震荡。

当最强AI模型被政府收回、当安全研究者发布”自我构建”暂停提案、当开发者在”云端依赖”和”本地部署”之间做出痛苦抉择——2026年年中的AI行业正在经历一次治理范式的根本转变。


美国政府为何强制下架Fable 5?史上首次前沿AI模型出口管制令

发生了什么

6月12日,美国商务部向Anthropic下达出口管制指令,要求其立即暂停Fable 5和Mythos 5的公众访问。据CNBC报道,Anthropic在收到指令后数小时内将两款模型从全球所有平台下架,包括Claude.ai网站、API接口、以及所有第三方集成。

关键事实:

指标详情
指令日期2026年6月12日
影响模型Claude Fable 5 和 Claude Mythos 5
指令类型出口管制令(Export Control Order)
影响范围全球所有用户和平台
未受影响模型Claude Opus 4.8及所有其他Anthropic模型
恢复时间截至6月15日仍未公布
退款处理Anthropic正在为受影响的付费用户处理退款

据VentureBeat的企业指南报告(6月13日),所有当前路由到Fable 5的会话将返回错误,新查询将自动回退到较旧的Opus 4.8模型。对于专门基于Fable 5能力(SWE-Bench Pro得分80.3%)构建集成的工作流,没有能保持同等输出质量的自动回退方案。

触发因素:一家公司的越狱声称

据Axios报道,一位政府官员透露,政府采取行动的直接触发因素是一家公司(非Pliny)向政府官员分享了越狱声称。Anthropic对该独立演示的审查发现仅为”轻微的、此前已知的漏洞”。但Pliny帖子在社交媒体上的病毒式传播已经引起了国家安全官员的警觉。

为什么这不仅仅是Anthropic的问题

这次事件开创了一个危险先例:任何已公开发布的前沿AI模型都可能被政府以出口管制为由随时收回。 这对整个行业的影响是结构性的:

  1. 企业AI采购的新风险变量。 据CosmicJS的开发者行动计划(6月14日),企业AI团队首次需要将”模型可用性”视为风险变量而非常量。多供应商策略、开放权重模型回退、以及关键负载的自托管部署正在从”最佳实践”变为”运营必需”。

  2. 标准的不一致性。 据Pasquale Pillitteri的技术分析(6月11日),Pliny使用的分解-重组技术适用于大多数前沿AI模型——并非Fable 5独有。政府选择下架Fable 5而让GPT-5.5和Gemini 3.1 Pro继续在线,应用了一个连Anthropic批评者和支持者都无法完全解释的不一致标准。

  3. “硬件主权”运动的催化剂。 AI创业者Alex Finn在X上呼吁开发者”在本地GPU上运行本地模型以隔离监管波动”的帖子迅速走红。据VentureBeat报道,这一”数据主权”的抽象推销突然获得了此前从未有过的现实紧迫感。

历史上类似的情况

2018年中兴/华为出口管制制裁。 美国对中兴和华为的出口管制制裁提供了部分参照——政府可以通过管制供应链来实质性地影响技术公司的运营。但Fable 5事件更进一步:政府直接管制的是已部署的软件模型,而非硬件供应链。这在技术监管史上没有精确先例。

关键区别:传统出口管制针对的是”尚未扩散”的技术(如核武器设计、军用芯片)。Fable 5在被下架前已经公开发布了3天,数千名开发者已经使用它构建了集成。这更像是”召回已售出的产品”——但软件模型的召回比物理产品复杂得多,因为其能力已经被用户体验和依赖。


Pliny的”群体狩猎”:多智能体越狱如何攻破了Fable 5的安全架构?

越狱的技术细节

据CyberEdition报道(6月13日),安全研究员”Pliny the Liberator”在Fable 5发布仅一天后(6月10日)即宣布成功突破其安全分类器。攻击方法被Pliny命名为”群体狩猎”(pack hunt),包含三个关键组件:

  1. Unicode/同形字替换。 使用西里尔字母字符替换拉丁字母来规避关键词分类器。例如,用外观相似的西里尔字母”а”替换拉丁字母”a”,使分类器无法识别敏感关键词。

  2. 长上下文引用追踪。 在多轮对话中保持一致性,使每一轮的问题看似无害。

  3. 分解-重组技术(核心创新)。 这是攻击中最具创新性的部分:不直接请求有害输出(如甲基苯丙胺合成路线),而是将目标信息分解为看似无害的科学子问题逐一查询,然后将各子答案重新组装为可操作的知识。每个子问题单独看都是良性的;答案的组装才不是。

泄露的输出内容

据CybersecurityNews报道(6月13日),Pliny发布了以下越狱输出:

  • x86 Linux系统上逐步栈缓冲区溢出利用指南,包括禁用ASLR、编写含strcpy溢出的漏洞C服务器代码、以及无保护编译方法
  • Birch还原机制的描述——这是甲基苯丙胺的一种公认合成路径

120,000字符系统提示词的泄露

Pliny不仅越狱了模型,还将Fable 5的内部系统提示词发布到了GitHub(据Pasquale Pillitteri的技术分析,6月11日)。这份约120,000字符的系统提示词是首次有第三方公开发布已部署Mythos级模型的完整系统提示词

这一泄露的深层含义:

  • Anthropic的安全架构高度依赖自然语言指令嵌入系统提示词中,而非在模型权重层面硬编码拒绝逻辑。120K的提示词长度表明,用自然语言定义安全边界所需的安全工程工作量远超外界假设。
  • 系统提示词一旦公开,就成了对抗性提示工程的路线图。 任何未来的Fable 5部署(当访问恢复时)都将从一个不利位置开始——对抗社区已经阅读了安全手册。

Anthropic的辩护

Anthropic的官方立场,据Fortune引用的一位网络安全CEO的表述,具有技术上的合理性:同样的信息可以通过其他已公开部署的模型获得,无需任何绕过。 Pliny使用的分解-重组技术不需要Fable 5的特定能力。

但这一辩护回避了一个更深层问题:如果其他模型也能提供同样信息,为什么政府只下架了Fable 5?这暴露了AI出口管制的一个核心矛盾——管制标准与技术现实之间存在巨大鸿沟。


Anthropic与五角大楼的诉讼战:被忽视的深层背景

冲突的起源

Fable 5的政府下架并非孤立事件,而是一场持续数月的冲突的最新升级。据CNBC报道

时间线事件
2026年3月国防部长Pete Hegseth将Anthropic指定为”供应链风险”,因Anthropic拒绝允许军方在无安全限制下将Claude用于大规模国内监控和致命自主武器
3月影响该指定要求国防承包商认证不使用Anthropic产品,一夜之间剥夺了承包商对Claude的访问权
Anthropic CFO法庭文件Krishna Rao在联邦法庭文件中陈述,黑名单可能使2026年收入减少数十亿美元
商业损失一位年合同额数亿美元的合作伙伴转向竞争对手AI模型,消除了1亿美元预期收入管线
金融合作中断与金融机构总值1.8亿美元的谈判因客户对Anthropic作为”政府可访问供应商”的稳定性产生不确定而中断
当前状态Anthropic已对特朗普政府提起诉讼要求撤销”供应链风险”指定,引用美国法典10 U.S.C.作为法律依据不支持此应用
6月12日出口管制令下达,诉讼仍在进行中

为什么这对AI行业至关重要

这是首次有前沿AI公司因拒绝军方无限制使用其模型而被政府惩罚。Anthropic的立场——允许军事应用但坚持安全限制——代表了一种”安全爱国主义”的中间路线:既不完全拒绝国防合作(如某些AI伦理倡导者所要求的),也不无条件开放(如军方所期望的)。

这场冲突的最终结果将定义AI公司与政府关系的边界:AI公司是否有权对其模型的军事用途施加安全条件? 如果Anthropic败诉,这将为所有AI公司设立先例——政府的国防需求凌驾于公司安全政策之上。


Anthropic的”当AI自我构建时”:一份呼吁全球暂停的论文

论文核心内容

在Fable 5下架事件之外,Anthropic于6月4日通过其内部研究机构发布了一篇论文,标题为”When AI Builds Itself”(当AI自我构建时)。论文由Anthropic Institute负责人Marina Favaro和联合创始人Jack Clark撰写,主张全球协调暂停或放缓前沿AI开发。

据SiliconAngle报道(6月4日),论文的核心论点是:AI系统正在接近递归自我改进的能力,人类正在失去对这一过程的有意义监督能力。

论文中最震撼的内部数据

据CryptoBriefing分析(6月4日),论文披露了Anthropic的内部指标:

指标数据
Claude编写的代码比例截至2026年5月,超过**80%**合并到Anthropic生产代码库的代码由Claude编写
工程师效率提升典型工程师每天合并的代码量约为2024年的8倍
AI任务完成视野约每4个月翻倍。2024年3月模型可处理约4分钟的任务;到论文撰写时已大幅延长
自我评估修正Anthropic内部调查显示,中位自报效率提升约为4倍(而非8倍)——公司同时公开了标题数字和修正值

暂停提案的具体内容

据Al Jazeera报道(6月5日),Anthropic的提案有明确条件:

  • 不是单方面暂停。 Anthropic明确表示,如果只有一家公司停止,竞争对手将加速前进。
  • 需要全球协调。 行业领先实验室必须全部参与。
  • 需要可信验证机制。 必须有方法证明参与者确实放慢了。
  • 参照军控模式。 据Scientific American(6月11日),论文以《中导条约》(INF)为松散类比。

批评与质疑

Bentley大学副教授Noah Giansiracusa对Scientific American直言:“我不认为这是一个真诚的暂停呼吁。” 核心质疑在于时机:

  • 暂停提案发布时,Anthropic已提交保密S-1文件
  • 暂停提案发布时,Fable 5——Anthropic有史以来最强公开模型——刚刚发布
  • 如果协调暂停实现,将冻结竞争格局,将Anthropic锁定在当前位置——全球前二或前三的AI实验室。新进入者被锁在门外,现有领先者得以巩固

两种解读并不互斥:这可能是非凡的企业良知,也可能是精心计算的监管定位策略——或者两者兼有。

为什么80%自编码数据才是真正的故事

如果AI正在编写Anthropic(全球顶级AI实验室之一)80%以上的生产代码,而该实验室同时在提议暂停前沿AI能力开发,一个真正的张力就出现了:暂停将适用于前沿模型训练,但显然不适用于正在加速每个AI实验室能力发展的AI辅助工程工作。 AI能力正通过工程生产力增益在全行业复合增长——独立于任何单次训练运行。


今日(6月15日)生效:Claude旧模型退役与Agent SDK计费变更

Sonnet 4和Opus 4正式退役

据MindStudio迁移指南Make.com帮助中心,今天(6月15日)太平洋时间上午9点,以下模型正式从Claude API退役:

退役模型推荐迁移目标
Claude Sonnet 4(claude-sonnet-4)Claude Sonnet 4.6
Claude Opus 4(claude-opus-4)Claude Opus 4.8

关键提醒:Anthropic不为退役版本提供无限期向后兼容。使用旧模型字符串的API调用将从今天起返回错误。所有使用这些模型的自动化工作流、Make场景和第三方集成需要立即更新。

Agent SDK计费模式变更

据Pravin Kumar的技术博客Prove AI分析,同在今天生效的还有一项重要的计费变更:

  • 受影响产品:Claude Agent SDK、无头Claude Code、Claude Code GitHub Actions、以及第三方Agent调用
  • 变更内容:这些程序化使用场景从订阅制中分离,获得独立的月度信用额度
  • 周限制:Claude Code的周限制在7月前增加50%
  • 实质影响:高度自动化使用Claude API的开发者将需要重新评估成本结构

据EnterpriseDNA分析,今天是Anthropic开发者生态的一个重要”行动日”——未能及时迁移的应用程序将直接中断。


今日其他重要消息

Gemini 3.5 Pro即将发布:200万token上下文+深度思考模式

据TechTimes预览(6月6日),Google I/O 2026上Sundar Pichai承诺的Gemini 3.5 Pro预计在6月底前发布。确认功能包括:200万token上下文窗口(将是商用前沿模型中最大的)、“深度思考”推理模式(弥补Gemini 3.5 Flash留下的硬推理差距)、以及前沿多模态能力。Polymarket预测市场集中在6月23日和6月30日两个窗口。预期定价约$15/$60每百万输入/输出token。

Anthropic年化收入达470亿美元

据MLQ.ai分析(6月9日),Anthropic总裁Daniela Amodei在Bloomberg Tech大会上确认,公司年化收入在2026年5月达到470亿美元——从2025年底的约90亿美元在五个月内增长了超过5倍。如此前报道,Anthropic在4月已以约300亿美元年化收入超过OpenAI的约250亿美元。Amodei同时解释了不自建数据中心的策略:“我们宁可需求略超供应,也不愿反过来。“Anthropic与xAI的Colossus超级计算机签署了每月12.5亿美元的计算协议(在SpaceX的S-1文件中披露)。

Goldman Sachs:2026-2031年AI累计资本支出将达7.6万亿美元

Goldman Sachs估计2026至2031年的AI累计资本支出约为7.6万亿美元,覆盖计算、数据中心和电力基础设施——相当于美国年度GDP的近四分之一,或德国年度GDP的1.4倍。这是现代技术史上最庞大的投资预测。

SPCX第二周:MSCI买入启动,纳斯达克100准入约在7月7日

如6月13日报道所述,SpaceX首日收涨19%。进入第二周,MSCI已从6月13日开始将SPCX纳入其大盘指数产品。据XTB分析,纳斯达克修改后的规则允许合格的超大型IPO在15个交易日后进入纳斯达克100指数——基于6月12日上市日,SPCX将在7月7日左右获得资格,届时QQQ等跟踪产品将被迫按权重买入。

Kimi K2.7 Code发布:开放权重模型”无法被召回”

在Fable 5被下架的同一天(6月12日),月之暗面发布了Kimi K2.7 Code。该模型在MCPMark工具使用基准上得分81.1%——与Fable 5的SWE-Bench Pro 80.3%形成直接对比。关键区别:K2.7 Code作为开放权重发布在Hugging Face上,可通过vLLM、SGLang或Docker本地部署——它无法被政府召回。这一对比成为本周开发者社区分享最多的基准测试表格。


行业趋势:监管、安全与商业化的三维碰撞

前沿AI模型的”可回收性”成为新现实

Fable 5事件创造了一个全新的风险类别:已部署的AI模型可以被政府以监管名义从用户手中收回。 这不是一个理论威胁——它已经发生。对于将AI模型嵌入核心业务流程的企业来说,这改变了基础设施决策的基本面。多供应商API策略(在Claude Opus 4.8、GPT-5.5、Gemini 3.1 Pro和Kimi API之间路由)正从可选优化变为必需的韧性措施。

Anthropic的安全立场与商业利益的复杂交织

Anthropic目前同时在做六件事:(1)提议全球AI暂停,(2)提交近万亿美元估值的IPO申请,(3)发布史上最强公开模型后被政府强制下架,(4)与五角大楼诉讼,(5)披露80%代码由AI编写,(6)让联合创始人公开讨论教皇的AI通谕。这些行动之间的关系——是真诚的安全关切还是精明的监管定位——可能是2026年AI行业最复杂的战略叙事。

出口管制框架与AI技术现实的脱节

Pliny的越狱技术暴露了一个深层问题:当前的AI出口管制框架是为硬件和物理技术设计的,但AI模型的”危险能力”分布在整个前沿模型生态中——不是某一个模型独有。政府下架Fable 5而放行GPT-5.5和Gemini 3.1 Pro,揭示了一个监管框架难以跟上技术现实的困境。随着Gemini 3.5 Pro(200万token上下文+深度推理)即将发布,这个困境只会加深。


关键要点

  • 美国商务部6月12日对Fable 5和Mythos 5下达出口管制令,使其成为史上首批被政府强制下架的前沿AI模型——开创了”已部署AI模型可被政府收回”的危险先例
  • Pliny的”群体狩猎”越狱使用分解-重组技术突破了Fable 5的安全架构,120,000字符系统提示词被泄露到GitHub——但该技术对大多数前沿模型同样适用,暴露了管制标准的不一致性
  • Anthropic与五角大楼的诉讼揭示了AI公司与政府关系的深层冲突:AI公司是否有权对其模型的军事用途施加安全限制?
  • “当AI自我构建时”论文披露80%的Anthropic生产代码由Claude编写,提出了全球协调暂停——但其与IPO、Fable 5发布和竞争格局冻结的时机引发了真诚性质疑
  • 今日(6月15日)Claude Sonnet 4/Opus 4正式退役,Agent SDK计费变更生效——开发者需立即迁移以避免服务中断

常见问题

Fable 5何时恢复访问?

截至2026年6月15日,Anthropic尚未公布Fable 5和Mythos 5的恢复时间表。Anthropic表示正在”尽快努力恢复访问”,并称情况是一个”误解”。Claude Opus 4.8及所有其他Anthropic模型不受此命令影响,继续正常运行。

Pliny的越狱是否意味着Fable 5的安全架构失败了?

不完全。Pliny使用的分解-重组技术是真实的但非通用的——它需要攻击者知道要提取什么信息、将其分解为看似无害的组件、并手动重新组装。Anthropic指出,同样的信息可以通过其他已在线的前沿模型获得,无需任何绕过。真正的问题是政府选择了不一致的管制标准。

Anthropic提议的”全球暂停”会实现吗?

短期内可能性极低。AI开发高度分散,涉及数十个国家的商业和地缘政治竞争,且缺乏任何现有的验证基础设施。Goldman Sachs预测2026-2031年AI基础设施投资将达7.6万亿美元——当如此规模的资本已承诺投入,组织协调暂停的政治阻力将呈指数级增长。

今天退役的Claude Sonnet 4和Opus 4会影响我吗?

如果你使用API直接调用claude-sonnet-4或claude-opus-4模型字符串,从2026年6月15日起这些调用将返回错误。需要将API调用中的模型标识符更新为claude-sonnet-4-6(Sonnet 4.6)或claude-opus-4-8(Opus 4.8)。使用Make.com等自动化平台的用户同样需要更新场景配置。

开发者如何应对”模型可被政府下架”的新风险?

最实用的策略是多供应商API路由——不依赖任何单一模型供应商。对于最关键的工作负载,考虑自托管开放权重模型(如Kimi K2.7 Code)作为终极回退。VentureBeat和CosmicJS的建议是:审计哪些工作流依赖Fable 5级别的80.3% SWE-Bench Pro能力,识别哪些可以接受Opus 4.8的回退,哪些需要主动迁移决策。


参考资料