AI 观察👀

记录、思考,but AI

刊载于

Google I/O 2026开幕日:新Gemini被指落后Mythos,五角大楼将Anthropic排除在机密AI名单之外

Google I/O 2026首日keynote发布新Gemini模型、Gemini Intelligence和Android XR眼镜,但多家分析指出其性能落后于Anthropic Mythos和OpenAI GPT-5.5;同日,美国战争部宣布与8家AI公司签署机密网络部署协议,Anthropic被明确排除——恰逢其"供应链风险"标签案口头辩论开庭。

AI 分析 Google Gemini Anthropic 五角大楼 AI军事 Android XR 行业动态

今天(5月19日)是2026年AI行业日程表上最密集的一天。Google I/O 2026在山景城Shoreline Amphitheatre拉开帷幕,Sundar Pichai登上keynote舞台发布下一代Gemini模型、Gemini Intelligence主动式AI和Android XR眼镜。但在Google试图夺回AI话语权的同时,华盛顿和旧金山正在发生两件可能更具深远影响的事件:美国战争部正式宣布与8家AI公司签署机密网络部署协议——Anthropic被明确排除在外;而在加利福尼亚联邦法院,Anthropic与美国政府之间关于”供应链风险”标签的法律战于今日进入口头辩论阶段。纽约时报5月12日的报道则将Claude Mythos”过于危险而无法公开发布”的争议推向了新的高潮。

这三条线索交汇在一个核心问题上:当AI能力正在重塑军事、金融和网络安全的规则时,谁能决定哪些AI足够安全?


Google I/O 2026首日:Gemini能追上前沿吗?

发布了什么

Google I/O 2026 keynote于太平洋时间上午10点开幕。如昨日报道所述,Google此前已在5月12日的Android Show上预发布了大部分Android和消费端内容——Gemini Intelligence、Googlebook和Android 17。今日keynote的真正焦点是下一代Gemini模型。

根据TechTimes此前分析和多方信源,今日发布/确认的核心内容如下:

发布内容关键细节竞争定位
新Gemini模型版本号未最终确认(分析师预测Gemini 3.2/3.5,Gemini 4.0可能性较低)约等于GPT-5.5水平,明显落后于Claude Mythos
Gemini 4 Deep Think(研究版)ARC-AGI2基准84.6%,Codeforces 3,455 ELO(编程全球前0.2%)研究基准领先,但公众版本差距明显
Gemini Intelligence主动式AI,跨手机/手表/汽车/眼镜运行多步任务首个跨设备Agent平台,但需旗舰SoC+12GB RAM
Android XR眼镜Samsung”Jinju”(50g,骁龙AR1芯片,1200万像素)、XREAL Project Aura、Warby Parker、Gentle Monster首个平台级智能眼镜生态
Googlebook/Aluminium OSAcer/ASUS/Dell/HP/Lenovo今秋上市,完整Chrome+Android原生应用直接与Windows/macOS竞争
Gemini Omni/Veo 4应用内原生视频生成,4K分辨率,30秒片段被泄露后正式发布
Personal Intelligence扩展免费用户将获得Gmail/Photos/Drive/Calendar的AI连接覆盖20亿Google用户

为什么这次的竞争定位如此关键

TechTimes的分析最为直白:新Gemini模型”将大致落在OpenAI GPT-5.5的水平,并明显落后于Anthropic的Claude Mythos”。文章引用多个未具名信源称,此次更新是”有意义的改进”但”不是阶跃式跳跃”。

这一判断的背景是:Claude Mythos Preview于4月7日发布系统卡片,在18项基准测试中领先17项,在漏洞发现和自主编程任务上达到”定性更高的水平”。OpenAI的GPT-5.5于4月24日发布,是第二个参照点。Google今天发布的Gemini将立即被放在这两个模型的坐标系中衡量。

Google的核心策略是”生态牌”而非”模型牌”。 Gemini Intelligence跨设备主动式AI、Android XR四伙伴眼镜生态、Googlebook五OEM厂商联合发布——这些都不是单点模型突破,而是试图用分发和整合弥补模型性能差距。正如Trending Topics的分析所言:Google必须证明”通过数十亿设备的模型分发和广告/云基础设施的整合,能否补偿竞争对手在纯模型能力上的领先”。

Android XR眼镜:进入一个已经被调查的品类

Google确认了Android XR眼镜的首次公开上手体验环节。Samsung”Jinju”设备据报搭载高通骁龙AR1芯片、1200万像素Sony摄像头、蓝牙5.3,重量约50克。四家硬件伙伴——Samsung、XREAL、Warby Parker和Gentle Monster——将覆盖从技术导向到时尚导向的不同形态。

TechTimes 5月15日报道指出了一个关键的法律背景:英国信息专员办公室已于2026年3月5日对Meta Ray-Ban智能眼镜展开正式调查,同日美国联邦法院也受理了针对Meta眼镜的集体诉讼——指控承包商审查了包含用户更衣画面的录像。Meta在2025年下半年占据全球智能眼镜市场约82%份额。Google进入这一品类时,面临的不仅是竞争,还有正在升级的隐私合规风险。

历史上类似的情况

2019年Google I/O——Pixel 3a和Stadia。 当年Google在模型层面没有重大突破(BERT已提前发布),转而强调生态整合(Stadia云游戏、Nest Hub)。但Stadia最终因缺乏杀手级应用而关闭。当前Google的”生态牌”面临类似风险:如果Gemini模型持续落后,再好的生态整合也可能沦为”精美的容器装着过时的引擎”。


五角大楼排除Anthropic:8家公司获准机密AI部署

发生了什么

美国战争部5月16日正式发布公告,宣布与8家前沿AI公司签署协议,允许其AI能力部署在军方的机密网络(IL6和IL7级别)上:

获准公司关键背景
SpaceX/xAI2月完成合并,估值1.25万亿美元
OpenAI与五角大楼关系在2025年下半年快速升温
Google拥有 longstanding 军事合同历史
NVIDIA芯片供应商,同时提供AI模型能力
Microsoft通过Azure和OpenAI合作长期服务军方
Amazon Web Services最大的军方云服务提供商之一
Oracle新晋云基础设施玩家
Reflection较小但专注于安全AI的新创公司

被排除在外的:Anthropic。 公告中明确没有列出Anthropic,这与其和美国政府之间持续数月的法律纠纷直接相关。

DefenseScoop报道Breaking Defense均确认了Anthropic的缺席。

战争部公告还透露了一个惊人的使用规模:军方AI平台GenAI.mil在仅5个月内已有超过130万国防部人员使用,生成了数千万条提示词,部署了数十万个Agent。公告称这些能力”将许多任务从数月缩短到数天”。

为什么这很重要

这是AI军事化进程中一个分水岭时刻。 8家公司获准在IL6/IL7机密环境部署AI——这意味着美国军方已将前沿AI视为与加密通信同等核心的军事基础设施。而Anthropic的被排除,说明在AI竞赛中,“与政府对抗”的代价可能是失去最大的企业客户之一。

对Anthropic的直接影响可能是数十亿美元。Yahoo Finance报道,Anthropic已公开表示五角大楼禁令可能”损失数十亿美元”。

更深层的问题在于”vendor lock”。 战争部公告特别强调要”防止AI供应商锁定”和”确保长期灵活性”。但8家获准公司与1家被排除之间的差距,已经在事实上创造了一种”认证俱乐部”——一旦被排除在外,重新进入的门槛可能越来越高。

Anthropic法律战今天进入关键时刻

The Hill报道KQED报道确认:美国上诉法院此前驳回了Anthropic要求暂停”供应链风险”标签的请求,但将**口头辩论定于5月19日(今天)**在加利福尼亚联邦法院举行。

事件脉络:

  • 2026年2月:Trump政府将Anthropic列为”供应链风险”实体,限制其与联邦政府的业务往来
  • 2026年3月:加利福尼亚联邦法官暂时阻止了该标签的实施,称政府的论据”不足”
  • 2026年4月:上诉法院驳回了Anthropic要求暂停的紧急请求,但将口头辩论排期到5月19日
  • 2026年5月16日:战争部宣布8家AI公司机密网络协议,Anthropic被排除
  • 2026年5月19日(今天):口头辩论开庭

这意味着:Anthropic在法庭上与美国政府辩论的当天,美国政府正在没有Anthropic的情况下推进迄今最大规模的AI军事部署。 这种时间上的重叠——无论是有意安排还是巧合——都发出了一个明确信号:法律争议不会放慢AI军事化的速度。


Claude Mythos”过于危险”争议:网络安全的新纪元

新的报道和分析

今日Google I/O keynote的核心背景之一,是纽约时报5月12日的深度报道Bruce Schneier在The Guardian 5月8日的专栏对Claude Mythos网络安全能力的新分析。

核心事实:Anthropic于4月7日发布Claude Mythos Preview系统卡片,随后宣布将拒绝向公众完整发布该模型,理由是其网络安全能力——特别是自主发现和利用软件漏洞的能力——被认为过于危险。正如The Hill报道所言,这是AI行业首次有公司以”过于危险”为由拒绝发布已完成的模型。

Schneier的分析最为值得注意。 这位著名密码学家和安全专家在Guardian专栏中指出:“发现和利用漏洞似乎比发现和修复漏洞更容易。所有这些都指向一个更加危险的短期未来。“这一判断如果成立,意味着AI正在打破进攻与防御之间的历史平衡——网络安全领域可能进入”攻击优势”时代。

Cato研究所的分析提供了另一个视角:今天被认为”不可获得、不可思议或危险”的能力,明天可能变得司空见惯。问题不在于Anthropic是否应该发布Mythos,而在于整个行业是否需要一个比”公司自我审查”更系统化的安全评估框架。

为什么这与Google I/O形成鲜明对照

Google今天在I/O上展示的Gemini模型被评价为”落后于Mythos”,但Google仍然发布了它。 Anthropic拥有被广泛认可为最强的模型,却因为”过于危险”而拒绝完整发布——并因此被排除在五角大楼机密AI名单之外。

这创造了一个奇特的悖论:在当前的制度下,AI越安全(即越弱),越可能获得政府合同;AI越强大,反而可能被边缘化。 这一激励结构如果持续下去,可能导致AI公司在安全报告上”自我矮化”以换取市场准入——这与AI安全的初衷完全相反。


行业观察:三条线索的交汇

今天的三条主线——Google I/O、五角大楼AI部署、Anthropic法律与安全争议——共同揭示了一个正在成形的行业新格局:

1. AI竞赛从”模型性能”转向”制度嵌入”。 Google不是靠最强的模型赢得I/O的关注,而是靠Gemini Intelligence跨设备Agent、Android XR四伙伴生态和Googlebook五OEM厂商联盟。同样,五角大楼不是选择最强的AI(Mythos被公认领先),而是选择”合规的”AI。这说明AI的竞争维度正在扩展:模型性能只是门票,分发渠道、制度关系和合规能力才是决胜因素。

2. “AI军事化”从概念进入了操作阶段。 GenAI.mil在5个月内130万用户、数千万提示词——这不是试验项目,而是大规模部署。8家公司获准进入IL6/IL7机密环境,意味着AI已成为美国军事决策链的正式组成部分。

3. “安全悖论”正在扭曲竞争格局。 Anthropic拥有最强的模型和最严格的安全标准,却因此被排除在最大的政府合同之外。这种激励扭曲如果不纠正,可能导致整个行业在安全问题上”竞底”。


关键要点

  • Google I/O 2026首日发布新Gemini模型、Gemini Intelligence跨设备Agent、Android XR眼镜生态和Googlebook,但多方分析指出新模型性能落后于Anthropic Mythos和OpenAI GPT-5.5,Google选择以生态整合而非模型性能竞争
  • 美国战争部宣布与8家AI公司签署机密网络部署协议,Anthropic被明确排除——GenAI.mil已获130万国防部人员使用,AI军事化进入大规模操作阶段
  • Anthropic”供应链风险”标签案今日在加州联邦法院进行口头辩论,与五角大楼排除决定形成同日压力
  • Claude Mythos”过于危险”争议持续升级,Bruce Schneier在Guardian指出AI可能打破网络安全的攻防平衡,引发对行业安全评估框架的系统性反思
  • “安全悖论”正在扭曲AI竞争格局:最强的模型因安全担忧而被边缘化,较弱的模型因合规而获得政府合同

常见问题

Google I/O 2026发布的Gemini模型与Claude Mythos差距有多大?

据多方分析,新Gemini模型性能约等于OpenAI GPT-5.5水平,在编程基准测试和推理能力上明显落后于Claude Mythos。不过Google的策略是通过跨设备生态整合和分发优势来弥补模型性能差距。

为什么Anthropic被排除在五角大楼AI协议之外?

直接原因是Anthropic与美国政府之间关于”供应链风险”标签的法律纠纷。Trump政府于2026年2月将Anthropic列为”供应链风险”实体,尽管联邦法官曾暂时阻止该标签,但案件仍在审理中,五角大楼选择不将其纳入机密AI部署计划。

Claude Mythos为什么被认为”过于危险”?

Anthropic表示Mythos在自主发现和利用软件漏洞方面达到了前所未有的水平,可能被恶意行为者用于大规模网络攻击。安全专家Bruce Schneier指出AI可能正在打破网络安全的攻防平衡,使攻击比防御更容易。

Gemini Intelligence对普通用户意味着什么?

Gemini Intelligence是Android上的主动式AI,能在无需用户提示的情况下执行多步任务(如根据日历事件预订停车位、自动完成网页表单等)。但它需要旗舰级芯片和12GB RAM,这意味着许多当前旗舰手机也无法运行。

接下来应该关注什么?

5月20日Google I/O第二天将有更多开发者session和Google Marketing Live;Anthropic法律案的口头辩论结果可能在未来数周内公布;OpenAI的GPT-6训练已于3月24日完成,发布可能”几周内”到来——这将进一步加剧模型竞赛。


参考资料