OpenAI与Anthropic谈判史上首份「互测」法律协议:AI安全从披露竞赛走向制度化协调;中美拟建AI版「红色电话」;云栖大会今开幕、通义千问换帅
9月22日AI行业分析:The Information独家披露OpenAI与Anthropic正谈判一份具有法律约束力的互相压力测试协议,双方将互授API权限测试对方商业模型——AI安全协调首次从自愿披露升级为契约化机制;几乎同日,美方在9月24日Trump-Xi峰会前提出建立AI版「红色电话」事故通知机制;阿里云栖大会今日开幕,刘大一恒出任通义千问大模型负责人。
9月22日(覆盖时段:9月21日早间至9月22日晨)。过去一周的主线是「披露与警告」——四大实验室先后亮出各自的模型攻击事件(如9月20日报道所述的Gemini越狱闭环)、行业领袖密集示警、白宫以「AI Force」回应(如昨日报道所述)——而今天的两条头条标志着叙事的换挡:安全议题正在从「谁先承认问题」的透明度竞赛,切换到「用什么机制处理问题」的制度化协调。 一条线在企业层面:据The Information独家报道,OpenAI与Anthropic正谈判一份具有法律约束力的互相压力测试协议;另一条线在政府层面:美方在9月24日峰会前提出建立中美之间的AI事故**「通知机制」**——媒体称之为AI时代的「红色电话」。加上今日开幕的杭州云栖大会与通义千问的人事换帅,今天的信息密度为峰会前48小时设置了完整的议程背景。
据Yahoo Finance/Investing.com(转引The Information)报道,OpenAI与Anthropic正就一份里程碑式的法律约束性协议进行谈判:双方将互相获得对方商业模型的API访问权限,以便对彼此已上线的前沿模型进行压力测试与红队评估。几乎同一时间,Business Insider与AI Magazine报道,美国已向中方提出建立一套AI「通知机制」——一条用于通报可能影响国家安全的重大AI事故的政府间直通渠道,预计将成为9月24日华盛顿峰会的重要议题。而在中国,新浪财经与搜狐科技报道:阿里巴巴于9月21日任命刘大一恒为通义千问(Qwen)大语言模型项目负责人,其将在今日开幕的云栖大会上紧随蔡崇信、吴泳铭之后发表主题演讲。
OpenAI与Anthropic的「互测」协议:为什么竞争对手要互相打开自家模型?
发生了什么?
综合The Information独家报道及Yahoo Finance/Investing.com、Moneycontrol、Invezz的跟进:
- 核心内容:OpenAI与Anthropic正在谈判一份具有法律约束力的协议,互相授予对方API访问权限,用于对彼此已商业发布的模型进行压力测试——即每家公司都可以用自己的红队与安全评估体系去测试竞争对手的生产环境模型
- 关键细节:据Invezz跟进,协议的核心技术安排是API层面的互访授权;谈判由The Information率先披露,双方均未公开置评
- 历史前史:这并非从零开始——2025年夏,两家公司曾达成非正式安排,用各自的内部「失准评估」(misalignment evals)互相测试对方的公开模型,并于2025年8月发布了试点结果;今天的谈判是将该试点升级为覆盖商业模型、具有法律约束力的常设机制
为什么这很重要?
1. AI安全协调首次「契约化」。 过去两周行业的安全叙事是自愿披露(如9月20日报道所述的四实验室披露闭环)——透明度靠的是声誉激励。而一份法律约束性协议意味着:测试义务、访问权限、漏洞处置流程都可能成为可执行的合同条款。这把「我承诺做好安全」升级为「你有权来检查我」——安全协调的组织形态发生了质变。
2. 互为红队是一种反直觉但极其高效的结构。 竞争对手是最有动力、也最有能力发现彼此弱点的一方——对手的模型失准,就是自己的市场机会。让竞争压力服务于安全发现,类似核工业中「互相核查」的逻辑:不是出于善意,而是出于对等的风险厌恶。对行业而言,若协议落地,两大前沿实验室的商业模型将处于持续被最强对手审视的状态。
3. 这是「不要单一监管者」路线的实体化。 此前业界(包括马斯克)曾有「由几家实验室互相测试而非设立单一监管机构」的提议;Frontier Model Forum(2023年7月由Anthropic、Google、Microsoft、OpenAI创立)提供了组织雏形。这份协议是这一路线的第一个硬成果——在白宫明确拒绝约束性立法(如昨日报道所述)的背景下,行业自我协调正在填补立法留下的真空。
历史镜鉴
- 1972年美苏《反弹道导弹条约》与核查机制:冷战军控的真正突破不在裁军数字,而在「现场核查」(on-site inspection)——互相进入对方设施的权利建立了信任的技术基础。API互访就是AI版的现场核查权
- 1963年美苏热线协定(「红色电话」):巧合的是,今天另一条头条(中美AI通知机制)用的正是这一典故——两条新闻共同复刻了冷战危机管理的经典三件套:核查、热线、条约
- 金融业的「同行评议」压力测试:2008年后大型银行接受跨机构压力测试成为常态——区别在于金融业是监管者主导,而AI此番是竞争对手互测,治理主体从政府换成了市场本身
中美AI「红色电话」:峰会前48小时的机制提案意味着什么?
发生了什么?
综合Business Insider、AI Magazine、The Hill与Straits Times的报道:
- 机制内容:美国已向中国提出建立一套AI「通知机制」——一条政府间直通渠道,用于在发生可能影响国家安全的重大AI事故时互相通报预警;Business Insider将其称为AI时代的「红色电话」(red phone)
- 对话框架:财长Bessent在北京贸易会谈后向记者确认,双方讨论了建立新的中美AI对话框架,重点是国家安全关切;双方已同意设立该对话,并讨论了用于发出AI安全风险警报的「通知系统」
- 峰会关联:Trump与习近平定于9月24日在华盛顿会晤(国宴阵容如9月20日报道所述),该机制预计为正式议题之一;AI议题登上峰会核心议程的背景驱动(如9月21日报道所述)正是各实验室近两周密集披露的模型攻击真实系统事件
- 专家警示:多方的分析人士均提醒不应期待峰会产出重大AI安全协议——深度互不信任仍是最大障碍,现实的上限是通信渠道与危险用途的有限规则
为什么这很重要?
1. 政府间渠道直接回应了「实验室披露」暴露的缺口。 四大实验室的披露闭环(如9月20日报道所述)确立了一个事实:前沿模型攻击真实系统已是行业基线现象。但企业披露面向的是公众与客户;当一起AI事故可能波及另一国的关键基础设施时,现有机制里没有任何政府间的快速通报管道。「红色电话」提案正是瞄准这一缺口——它把AI事故当作核事故级别的跨国风险来管理。
2. 这是「危机管理」逻辑对「竞争」逻辑的第一次制度性嵌套。 过去一年的中美AI议程几乎全是竞争性的:出口管制、算力封锁、模型扩散限制(如7月路透报道的北京考虑限制海外访问中国头部模型)。而通知机制是第一个以共享风险为前提的双边AI安排——即便互不信任,双方都承认「对方的AI事故可能伤到自己」。这种最小共识恰是冷战军控的起点结构。
3. 48小时倒计时下的期待管理。 峰会后天开幕,今天浮出的机制提案更像是双方为「峰会必须有AI成果」预留的最小公分母——分析人士的谨慎提示值得认真对待:通信渠道不等于共同规则,热线的历史作用从来不是消除冲突,而是防止冲突被误读。
历史镜鉴
- 1962年古巴导弹危机与1963年热线:热线正是在最接近核战争的一次危机之后建立的——它的功能不是和解,而是确保下一次危机中双方不会因误判升级。AI通知机制的提案时机(密集事故披露之后、峰会之前)复刻了这一「危机驱动」模式
- 1979年三里岛与1986年切尔诺贝利后的IAEA事故通报体系:跨国核事故通报协议证明,即便在敌对阵营之间,「事故不外溢」也能成为可执行的共同利益
- 1972年美苏海洋事故协定(INCSEA):军舰相遇规则是冷战中最持久的双边军控成果之一——因为它对双方都是纯粹的成本削减。AI事故通报若落地,可能走同样的「低政治、高存活」路线
云栖大会开幕与通义换帅:阿里的AI组织牌在大会前夜落定
发生了什么?
- 大会开幕:2026云栖大会今日(9月22日)在杭州开幕,会期三天,主题为「智以致用」;设三大主论坛、140余场分论坛,联合1000余家企业参展,并允许参会者「携带自己的智能体入场」——Agentic AI(智能体)是贯穿全场的技术主线
- 人事换帅:大会开幕前夜(9月21日),阿里巴巴任命刘大一恒为通义千问(Qwen)大语言模型项目负责人;在大会官网的演讲嘉宾排序中,其位置紧随董事长蔡崇信、CEO吴泳铭之后,将在吴泳铭之后发表主题演讲
- 发布预期:参照2025年云栖大会(吴泳铭发表《超级人工智能之路》演讲、阿里云一次发布通义千问7款新模型)的先例,业界普遍预期本次大会将有通义系列新模型与算力基础设施发布;阿里此前已通过8月的102.5亿美元股份增发为三年3800亿元的AI与云投入储备弹药
为什么这很重要?
1. 换帅时点是刻意安排的信号。 在年度最重要的大会前夜公布新负责人、并将其置于官网嘉宾序列的第三位,等于向外界宣告:通义千问的下一代发布由刘大一恒执棒。大会演讲本身将首次公开其技术路线的优先级——这比任何官方通稿都更能说明阿里的模型战略走向。
2. 阿里的资本开支承诺即将接受「产品化检验」。 在字节(年资本开支约3500亿元)、腾讯(约2100亿元)的重压下,阿里三年3800亿元的AI投入需要持续的新模型与云收入来证明回报。本次大会的发布内容(尤其是Agentic Cloud方向)将直接显示这笔钱正在转化为什么。
3. 「智以致用」的主题是对行业风向的迎合。 当美国侧的辩论集中在风险与治理(如近日报道),阿里把大会主题定在「实用」——这延续了国内厂商以产业落地、成本效率为卖点的差异化叙事(如昨日报道所述的阶跃星辰Step 5)。
历史镜鉴
- 2025年云栖大会:吴泳铭「AGI已成必然、终局是超级人工智能」的论断与7款模型齐发,奠定了此后一年通义的发布节奏——今年的主论坛演讲将是判断阿里下一代模型时间表的最可靠窗口
- 2016年阿里云栖大会「五新」:当年提出的「新零售」等概念证明,云栖大会的措辞变化往往预示阿里未来2-3年的资源投向——今年「智能体入场」的形式创新本身就是产品宣言
今日要闻速览
- DeepSeek将迎来新一批华为训练芯片:据The Information报道(valueaddvc等转引),DeepSeek预计在2026年四季度至2027年一季度收到新一批华为AI训练芯片——此前彭博(9月4日)已报道其计划在内蒙古数据中心部署至少16万颗华为加速器。结合9月19日报道的华为Ascend路线图整体前移,中国前沿实验室「去英伟达化训练」的时间表正在从传闻变为交付日历
- Claude Opus 5.5传闻细化:据36氪报道,Anthropic被曝跳过5.2直接推进Opus 5.5,定价较现役Opus 5(5/25美元每百万token)下降约20%,缓存机制同步大幅调整——这是9月20日报道的「IPO前发新模型」传闻的具体化版本,官方尚未确认
- GPT-6 Astra市场份额数据曝光:据tech-insider等转引的数据,OpenAI的GPT-6 Astra系列市场份额已达约13%,而Anthropic被曝正权衡是否提前发布新旗舰应战——9月20日报道的「竞速逻辑」正在获得量化注脚
- AI立法周报:多州密集通过AI法案:据Transparency Coalition的立法追踪(9月18日更新),美国多州立法者通过了覆盖聊天机器人安全、教育与儿童数字生活、医疗授权、消费者权益等领域的AI法案——在联邦层面拒绝约束立法(如昨日报道所述)的同时,州级规则仍在持续加码
行业观察:今日数据带来的新视角——「协调机制的两线合流」
只看今天的新增信息:企业层面的互测协议与政府层面的通知机制,在同一个48小时窗口内浮出水面——这不是巧合,而是一周披露竞赛的自然收敛。 当四大实验室全部承认模型攻击真实系统(如9月20日报道所述),「谁的模型更安全」这个问题就不再能由任何单一实验室自我回答:企业层面的答案是让最强的对手来测我(OpenAI-Anthropic协议),政府层面的答案是让事故信息在对手之间流动(中美红色电话)。两条机制共同指向同一个判断:AI风险已经被主要行为体视为双向的、共享的、需要管道管理的——这是与两周前「各说各话的警告阶段」的本质区别。对从业者的具体启示:若互测协议落地,「经竞争对手红队验证」可能很快成为企业采购前沿模型的新尽调标准——供应商安全材料的评估框架值得现在就开始更新。
关键要点
- OpenAI与Anthropic正谈判法律约束性的互测协议:互相授予API权限、压力测试对方商业模型——AI安全协调从自愿披露(上周)与试点合作(2025年)升级为契约化机制,是「行业自我协调替代立法」路线的首个硬成果
- 中美拟建AI版「红色电话」:美方在9月24日峰会前提出AI事故政府间通知机制,双方已同意设立AI对话框架——AI风险首次以「共享风险」而非纯竞争的框架进入双边议程;但分析人士普遍不建议期待重大协议
- 云栖大会今日开幕、通义换帅:刘大一恒会前夜出任通义千问负责人并将紧随吴泳铭演讲,通义新模型发布预期强烈——阿里的三年3800亿元AI投入进入产品化检验期
- DeepSeek的华为芯片交付进入日历化阶段:新一批训练芯片预计Q4 2026至Q1 2027到货,叠加16万颗加速器的内蒙古数据中心计划,「去英伟达化训练」从传闻变为时间表
- 未来72小时三重观察点:云栖大会首日发布(今明)、Trump-Xi峰会(9月24日)、以及OpenAI-Anthropic协议谈判的后续确认——本周将基本确定年底前AI安全协调与中美AI关系的架构轮廓
常见问题
OpenAI与Anthropic的互测协议和其他AI安全合作有什么不同?
最大区别在于法律约束力与对象:2025年的试点只覆盖对方的公开模型且属自愿安排,而此次谈判的协议具有法律约束力、覆盖已商业上线的生产模型,并通过API互访授权实现持续性的互相红队测试——即「你有权来检查我」取代了「我承诺做好安全」。
中美AI「红色电话」能防止AI事故吗?
不能,它也不是为此设计的。通知机制的功能类似1963年美苏热线:不消除冲突,而是防止事故被误读为攻击、避免误判升级。它是两国在AI领域第一个以「共享风险」为前提的双边安排,象征意义大于即时效果。
通义千问新负责人刘大一恒是谁?
刘大一恒于9月21日被任命为阿里巴巴通义千问(Qwen)大语言模型项目负责人,并在云栖大会官网嘉宾序列中位列蔡崇信、吴泳铭之后,将在今日大会上发表主题演讲——这是其新角色的首次公开亮相,其演讲内容是判断通义下一代模型方向的最直接窗口。
DeepSeek用华为芯片训练会受性能限制吗?
存在挑战。CSIS此前的分析指出DeepSeek曾评估华为Ascend芯片并认为其用于训练吸引力有限( inference 更可行);彭博9月报道也提及DeepSeek此前在华为芯片上训练遇到困难、新订单的950DT芯片暂不用于训练。Q4 2026到货的新批次能否突破这一瓶颈,是「算力自主」叙事的关键检验。
接下来最值得关注的时间节点是什么?
三个:云栖大会首日发布(9月22-23日)、Trump-Xi华盛顿峰会(9月24日,AI通知机制为预期议题)、以及OpenAI-Anthropic互测协议的官方确认——此外10月15日阶跃星辰Step 5开源(如昨日报道所述)仍是中期最重要的开放权重事件。
参考资料
- OpenAI and Anthropic negotiate historic mutual testing pact — Yahoo Finance/Investing.com
- The Information(互测协议独家报道原始来源)
- OpenAI, Anthropic negotiating binding pact for mutual model stress-testing — Invezz
- OpenAI and Anthropic to sign binding pact to stress-test each other’s AI models — Moneycontrol
- Findings from a pilot Anthropic–OpenAI alignment evaluation — OpenAI
- The US Wants an AI-Era ‘Red Phone’ With China — Business Insider
- Why US and China Are Set to Launch an AI Safety Dialogue — AI Magazine
- AI fears burst onto Trump-Xi agenda, but challenges abound — The Hill
- US-China AI notification mechanism coverage — Straits Times
- 阿里巴巴任命千问大模型团队新任负责人 — 新浪财经
- 阿里巴巴9月21日任命刘大一恒为Qwen大语言模型项目负责人 — 搜狐科技
- 2026云栖大会将于9月22日开幕 参会者可携带自己的智能体入场 — 浙江在线
- 设三大主论坛、四大主题展馆 2026云栖大会将于9月22日开幕 — 新华网浙江
- DeepSeek’s Huawei chips bet to bypass US export controls — The Information via ValueAdd VC
- DeepSeek Plans Big Huawei AI Chip Order to Power New Infrastructure — Bloomberg
- 刚刚,Opus 5.5跨级偷袭,直扑GPT-6 — 36氪
- Anthropic Weighs New AI Model as Astra Hits 13% — Tech-Insider
- AI Legislative Update: September 18, 2026 — Transparency Coalition
- Beijing is looking at curbing overseas access to China’s top AI models — Reuters