Gemini 3.8 Flash正式发布并带来Cyber安全变体、Anthropic用Fable 5.1把智能体成本砍下45%——大模型竞争进入「门禁化分发」日
9月3日AI行业分析:谷歌如期发布Gemini 3.8 Flash(定价$0.75/$3.75)并首次推出网络安全变体3.8 Flash Cyber,通过新的Fairwind限权计划向政府与关键基础设施开放;Anthropic发布Claude Fable 5.1与Mythos 5.1,智能体任务成本最高降45%、缓存命中价砍75%;Tesla Cybercab今日奥斯汀发布。两家巨头同日把「危险能力」装进门禁系统,标志着前沿AI分发方式的结构性转变。
9月3日(覆盖时段:9月2日至9月3日晨)。昨天我们还在讨论谷歌「最早周三」发布Gemini 3.8 Flash的传闻(如昨日报道所述),今天它已经落地——而且带来的东西比预告多得多:除了主打编程与智能体的3.8 Flash本体,谷歌还发布了网络安全变体Gemini 3.8 Flash Cyber,并通过全新的Fairwind限权计划向政府、国家网络安全机构与关键基础设施运营商定向开放。几乎同一时间,Anthropic的Claude Fable 5.1(9月1日发布、9月2日评测刷屏)用最高45%的智能体任务降成本回应了开发者对价格的抱怨,而其孪生模型Mythos 5.1同样只通过限权的Project Glasswing项目分发。
两家公司、两个模型家族,在同一天做出了结构上完全相同的选择:把最强的「进攻性」能力(网络攻防)从公开API中剥离,装进需要资格审查的门禁系统。这不是巧合,而是前沿AI分发方式的一次集体转向——当模型能力逼近国家安全阈值,「谁能用」开始比「有多强」更早地定义产品形态。
Gemini 3.8 Flash发布之外,谷歌为什么同步推出一个「网络安全专用模型」?
发生了什么?
据Thurrott(Laurent Giret,9月2日)与谷歌官方声明:
- Gemini 3.8 Flash正式发布,距3.7 Flash发布仅三周。谷歌称其为「最智能的主力工作模型(workhorse model)」,在软件工程、智能体任务与专业领域多步推理上较3.7 Flash「显著提升」,且「常接近更高成本的前沿模型」水平,同时增强了对抗提示注入攻击的防护
- 定价:开发者与企业用户定价与3.7 Flash持平——每百万输入token 0.75美元、输出token 3.75美元;消费者侧通过Gemini应用、搜索AI Mode与Google Sheets向AI Pro/Ultra订阅者开放
- 同步推出Gemini 3.8 Flash Cyber:谷歌称其自主发现漏洞的能力「超越3.5 Flash Cyber以及显著更大的前沿模型」;Chrome安全团队的测试显示,3.8 Flash Cyber产出的Chrome漏洞正确补丁数量是更大体量商用最佳模型的2.6倍
- Fairwind计划:Cyber变体不进公开API,仅通过这一全新限权计划向政府与国家网络安全机构、关键基础设施运营商、核心技术平台开放,且「所有申请者都将被审查,以确保其有道德运营与研究的可靠记录」
- 值得注意的节奏信号:Thurrott指出,自3.6 Flash(7月底)以来谷歌已保持每三周一个Flash的节奏,而这个节奏也为迟迟未至的旗舰Pro系列争取了更多时间
为什么这很重要?
1. 三周一更的Flash已经成为谷歌事实上的主力产品线。 如昨日报道所述,旗舰Pro系列持续跳票,但3.8 Flash「接近前沿模型」的定位说明谷歌的策略很明确:用高频迭代的轻量模型守住开发者与智能体市场的基本盘,旗舰换代慢一点没关系。$0.75/$3.75的定价继续压低智能体应用的单位成本——这对按token指数级消耗的编程智能体来说,比榜单排名更实际。
2. Cyber变体+Fairwind是「双刃能力门禁化」的谷歌版本。 一个模型如果能在Chrome中发现漏洞并产出2.6倍于同行的正确补丁,它离「发现漏洞并利用漏洞」只有一步之遥。谷歌的解法不是阉割模型,而是把它放进需要资格审查的封闭分发渠道——政府网络机构、关键基础设施、经过尽调的技术平台。这与昨日报道的OpenAI硬件密钥强制令(TAC)逻辑同构:前沿攻防能力正在退出「人人可调」的时代。
3. 安全能力本身成了产品。 谷歌不是在做合规让步,而是在开辟一个新市场:国家网络防御机构愿意为「能自己找漏洞的模型」付费,而Fairwind的资格审查本身就是护城河。网络安全从模型的「风险项」变成了「营收项」。
历史镜鉴
- 曼哈顿计划的「知区分割」(1943-45):最危险的能力不是不发展,而是按需切割分发——Fairwind的按身份分发是这一逻辑的AI版
- Google Advanced Protection Program(2017):谷歌早有面向高风险用户的限权安全产品先例,Fairwind是该模式从「保护个人账户」到「分发进攻性能力」的升级
- 差异:过去的门禁保护的是用户,今天的门禁管控的是模型本身——风险对象从「账户被黑」变成了「能力被滥用」
Anthropic的Fable 5.1:为什么把智能体成本砍45%比性能提升更重要?
发生了什么?
据The Verge(9月2日)、VentureBeat与Anthropic官方公告:
- Claude Fable 5.1于9月1日发布、全平台可用:性能强于Fable 5,典型场景成本约降25%,复杂智能体任务最高降45%——主要来自缓存定价改革:缓存命中价从每百万token 1.00美元降至0.25美元(降幅75%),仅为正常输入价($10)的2.5%;输出维持$50
- 护栏「更精准」:Anthropic称Fable 5.1的误拦截显著减少——基础生物学问题不再被过度屏蔽(Mythos 5.1保留原有生物学限制)
- 网络能力分级:Fable 5.1首次被允许用于软件漏洞识别,但渗透测试、漏洞利用生成、二进制扫描等仍重定向至Opus系列
- Mythos 5.1仅通过Project Glasswing限权项目分发——面向网络防御者与生命科学家的孪生模型延续了受限渠道策略
- 企业隐私升级:Enterprise Frontier Safeguards承诺「完全隐私」——数据存储在客户自己的云服务器而非Anthropic侧,今秋开始推出
- 早期评测反应热烈:Every CEO Dan Shipper称其「是我们用过的最强编程模型,而且现在更快、更省token、说话像正常人」;Box CEO Aaron Levie称其智能体在同一测试中捕捉到了Fable 5遗漏的数据歧义
为什么这很重要?
1. 智能体经济学正在改写API定价表。 智能体的工作模式是长时间、多轮次、大量重复上下文——缓存命中价才是真实成本的主导项。把缓存价砍75%,等于直接改写了「一个智能体跑一天要花多少钱」的算式。这与Gemini 3.8 Flash维持$0.75低价同日发生:两家巨头在同一天用不同方式响应同一个现实——定价的竞争焦点从「每token多便宜」转向「重复上下文多便宜」。
2. 这是Anthropic对客户批评的一次「全单回应」。 Fable 5.1针对的是价格、数据保留、过度护栏三大抱怨——这在IPO传闻与索尼/华纳版权诉讼(如9月2日报道所述)的多重压力下,是Anthropic巩固开发者基本盘的关键动作。误拦截减少与「允许漏洞识别」尤其值得注意:它说明Anthropic正在从「一刀切拒答」转向「按任务风险分级放行」。
3. Mythos 5.1的Glasswing与谷歌的Fairwind形成了行业性对偶。 两家原本路线截然不同的公司,在同一天用相同的结构处理相同的问题:公开渠道卖通用能力,限权渠道分发攻防能力。这已经不是某家的合规选择,而是前沿能力分发的新行规雏形。
历史镜鉴
- AWS的连续降价(2011-2016):云计算早期,亚马逊靠每年多次降价锁定开发者——缓存经济学的精细化是同一剧本在token时代重演
- Anthropic自身的产品节奏:从Claude 3到Fable系列,「快速小迭代+倾听开发者抱怨」一直是其对抗更大对手的核心战术,5.1延续了这一打法
- 差异:这一次降价不是为了抢市场份额,而是为了守住智能体工作负载——这是收入结构变化(API→智能体)倒逼的定价改革
行业观察:「门禁化分发」与缓存经济学——今日数据带来的两个新坐标
今日两条主线给出了昨日尚未成形的新判断:
第一,攻防能力的分发结构完成了「双巨头对齐」。 昨天(如昨日报道所述)我们记录了OpenAI用硬件密钥(TAC)管控Astra的网络攻防能力;今天谷歌用Fairwind、Anthropic用Glasswing,把同一逻辑各自落地。三家头部公司在两周内各自建成了「限权分发渠道」,这意味着「前沿能力门禁化」已从单一公司的合规动作升级为行业基础设施。对开发者的直接影响是:下一代最强的安全类模型将无法通过公开API获得——渠道资格本身成为稀缺资源。
第二,定价战场从token单价转向缓存单价。 Gemini 3.8 Flash以$0.75维持低价、Fable 5.1把缓存命中价砍到$0.25,两家同日的动作指向同一判断:智能体时代的成本大头是重复上下文,而不是首次推理。谁先把「智能体跑一整天」的成本打到个位数美元,谁就锁定智能体开发者的默认选择。这也是中国厂商正在参与的同一战场——同期国内市场,智谱已把GLM系列限时5折(至9月9日),折后输入0.4元/百万token、输出1.4元,中外价格战在「谁更便宜」的表象下,比拼的其实是同一套缓存与调度工程。
今日要闻速览
- 英伟达收购Hugging Face进入收官阶段:据Bloomberg(9月2日),交易总额可能达到约140亿美元(基础协议129亿美元,如8月28日报道所述),最快本周内宣布——开源模型中立底座的归属即将尘埃落定
- Tesla Cybercab今日(9月3日)奥斯汀发布:据The Verge与Yahoo Finance,量产版Cybercab今日在得州发布——这是马斯克「纯视觉、砍掉LiDAR」异端路线的终极测试,也是实体AI方向本周最大的事件
- SEC与AI创业公司GenesisAI达成和解:据Law.com(9月2日),SEC指控其2019-2024年间向4000多名投资者募资超530万美元并存在虚假陈述——监管机构对「AI概念融资欺诈」的执法正在常态化
- 中国大模型价格战进入新回合:据投资界(9月2日),智谱对GLM系列限时5折至9月9日(折后输入0.4元/输出1.4元),DeepSeek维持峰谷定价(高峰输入3.0元/输出9.0元)——国产模型在低价之外开始分化出不同的定价哲学
关键要点
- Gemini 3.8 Flash正式发布($0.75/$3.75,三周一更节奏延续),并首次推出网络安全变体3.8 Flash Cyber——其Chrome漏洞补丁产出为更大商用模型的2.6倍,仅通过Fairwind限权计划向政府与关键基础设施开放
- Anthropic发布Fable 5.1/Mythos 5.1:智能体任务成本最高降45%、缓存命中价砍75%,护栏误拦截减少并首次允许漏洞识别;Mythos 5.1仅经Project Glasswing分发
- 「门禁化分发」成为行业新行规:OpenAI(TAC密钥)、谷歌(Fairwind)、Anthropic(Glasswing)两周内各自建成限权渠道——最强攻防能力正在退出公开API
- 定价竞争的焦点转向缓存经济学:智能体时代重复上下文才是成本大头,中外厂商在同一条战线上比拼
- Tesla Cybercab今日发布:纯视觉路线的终极测试,实体AI的下一个关键数据点
常见问题
Gemini 3.8 Flash Cyber普通开发者能用吗?
不能。Cyber变体仅通过谷歌Fairwind计划向政府与国家网络安全机构、关键基础设施运营商、核心技术平台开放,且所有申请者需通过道德运营记录审查。普通开发者可通过公开API使用标准版3.8 Flash。
Fable 5.1的降价是降价还是新定价结构?
主要是新定价结构。标准输入/输出价格($10/$50)未变,降幅来自缓存命中价从$1.00降至$0.25——对多轮智能体任务(大量重复上下文)而言等效于最高45%的综合成本下降,但对单轮简单对话影响有限。
为什么各家公司都在给AI能力设「门禁」?
因为前沿模型在网络攻防等领域的能力已接近国家安全风险阈值。限权分发(资格审查+封闭渠道)让公司既能商业化这些能力,又能控制扩散范围、规避监管追责——这是「能力越强、分发越窄」的结构性选择。
这对中国大模型厂商意味着什么?
中国厂商目前主要靠价格竞争(如智谱5折、DeepSeek峰谷定价)。若「门禁化分发」成为国际主流,中国厂商在攻防类模型上可能面临不同的监管路径与市场准入逻辑,国内限权分发机制的建立或将成为下一个观察点。
接下来最值得关注的时间点是什么?
今日特斯拉Cybercab发布会的实际数据、英伟达-Hugging Face交易的正式宣布(最快本周)、9月9日苹果秋季发布会与智谱5折截止日同日到来的「双九」节点。
参考资料
- Google Releases Gemini 3.8 Flash and Cyber Variant — Thurrott.com
- Anthropic launches Claude Fable 5.1 and says it’s up to 45 percent cheaper for agentic work — The Verge
- Anthropic’s Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads — VentureBeat
- Introducing Claude Fable 5 and Claude Mythos 5 — Anthropic
- Anthropic Launches Claude Fable 5.1 With Lower Costs and Fewer False Positives — MacRumors
- Nvidia Nears $14 Billion Hugging Face Deal This Week — Bloomberg
- Why Is Nvidia Willing to Pay $14 Billion for Hugging Face? — Barron’s
- Elon Musk’s heterodox robotaxi philosophy gets put to the test — The Verge
- Tesla Cybercab to launch Sept. 3 as robotaxi bet ramps up — Yahoo Finance
- SEC Files, Settles Case Against Dela.-Incorporated AI Startup — Law.com
- DeepSeek、智谱、阿里、腾讯,谁是大模型真正的斩杀线? — 投资界