AI行业简报 2026-04-21
Google与Marvell洽谈开发AI推理芯片直击NVIDIA软肋、DeepSeek V4预计本周发布首次搭载华为芯片、阿里Qwen3.6-Max-Preview登顶最佳国产模型、月之暗面Kimi K2.6发布并开源对标GPT-5.4、国家自然科学基金发布下一代AI重大研究计划、腾讯混元3.0正式落地。今日AI行业动态汇总。
AI行业简报 2026-04-21
周一开盘,AI行业迎来一个”国产大模型日”——4月20日一天之内,阿里和月之暗面同时发布新一代旗舰模型。阿里Qwen3.6-Max-Preview正式发布,在Artificial Analysis榜单登顶”最佳国产模型”,6项编程基准取得最高分;月之暗面Kimi K2.6发布并开源,在Humanity’s Last Exam得分54.0%排名第一、SWE-bench Pro 58.6%领先所有闭源模型,Agent集群能力全面升级。此外,Google正与Marvell洽谈开发两款全新AI推理芯片,目标直指NVIDIA垄断地位;DeepSeek V4预计本周发布,将是首个完全运行在华为芯片上的前沿大模型;国内层面,国家自然科学基金委发布下一代AI重大研究计划2026年度指南,腾讯混元3.0正式落地核心业务。以下是今日AI行业动态汇总。
今日要闻
Google与Marvell洽谈开发AI推理芯片,AI算力战场从”训练”转向”推理”
据Reuters 4月19日报道,Alphabet旗下Google正与芯片设计公司Marvell Technology洽谈,合作开发两款全新的AI推理芯片。这两款芯片旨在更高效地运行已训练好的AI模型——即”推理”(inference)环节,而非”训练”(training)环节。
背景:AI推理市场正在成为新的主战场
这一消息并非孤立事件,而是AI芯片竞争格局深刻变化的最新信号:
| 事件 | 时间 | 涉及方 |
|---|---|---|
| NVIDIA以$170-200亿收购推理芯片公司Groq | 2026年3月 | NVIDIA |
| Broadcom与Google签署长期TPU协议(至2031年) | 2026年4月6日 | Broadcom, Google |
| Anthropic与Google/Broadcom签署3.5GW TPU算力协议 | 2026年4月7日 | Anthropic, Google, Broadcom |
| Cerebras提交$230亿IPO申请,主攻推理市场 | 2026年4月17日 | Cerebras, OpenAI |
| Google与Marvell洽谈开发推理芯片 | 2026年4月19日 | Google, Marvell |
这一系列布局的共同指向是:AI产业的重心正从”训练模型”向”运行推理”转移。随着GPT-5、Claude Opus、Gemini等前沿模型相继成熟,AI公司需要的海量计算资源正在从”训练一次性投入”转向”推理持续消耗”。分析师预计,推理市场规模将数倍于训练市场。
为什么重要: NVIDIA在AI训练芯片市场的份额超过80%,但推理市场格局尚未定型。Google选择与Marvell合作(而非自研),说明即使是Google这样的技术巨头,也在寻求更快的产品上市路径。如果Google-Mavrell合作成功,加上NVIDIA的Groq收购、Cerebras的IPO和Broadcom的TPU协议,2026年下半年AI推理芯片市场将迎来前所未有的竞争。
来源:Reuters - Google in talks with Marvell to build new AI chips | Reuters - Broadcom signs long-term deal to develop Google’s custom AI chips | Silicon Republic - Anthropic, Google, Broadcom announce 3.5GW TPU deal | CNBC - Broadcom agrees to expanded chip deals with Google, Anthropic
DeepSeek V4预计本周发布:首个搭载华为芯片的前沿大模型
自4月初Reuters首次报道DeepSeek V4将使用华为芯片运行以来,市场一直高度关注其发布时间。据多家媒体报道,V4预计将在4月下旬(本周)正式发布。
已知信息汇总:
| 维度 | 详情 |
|---|---|
| 参数规模 | 约1万亿参数,370亿活跃参数(MoE架构) |
| 上下文窗口 | 预计支持100万Token |
| 模态 | 多模态(文本、图像、视频) |
| 测试模式 | 已发现”Vision”和”Expert”模式 |
| 硬件 | 华为昇腾(Ascend)AI芯片 |
| 基准成绩 | SWE-bench 81%(软件工程) |
| 核心突破 | 首个完全运行在国产芯片上的前沿AI模型 |
此前报道指出,DeepSeek此次一反常态,没有向NVIDIA和AMD提供早期版本进行性能调优,而是优先向华为等国产芯片供应商提供准备。这一决策背后的战略意图不言而喻:证明中国AI生态可以在没有NVIDIA的情况下运行最前沿的模型。
为什么重要: 如果V4在本周发布并确认使用华为芯片运行,这将是中国AI自主化的一个标志性事件。它将向全球证明:即使没有NVIDIA最先进的GPU,中国也能训练和运行世界级AI模型。这对全球AI芯片格局和中美科技竞争都将产生深远影响。
来源:Reuters - DeepSeek’s V4 model will run on Huawei chips | TechNode - DeepSeek V4 may launch this month | Gizchina - DeepSeek V4 expected to launch in late April | 联合早报 - DeepSeek V4将使用华为芯片
阿里Qwen3.6-Max-Preview发布:登顶Artificial Analysis最佳国产模型
4月20日下午,阿里正式发布Qwen3.6-Max-Preview——Qwen系列新一代旗舰模型的早期预览版。该模型在权威第三方评测榜单Artificial Analysis上登顶”最佳国产模型”,性能表现超过GLM5.1、MiniMax-M2.7等模型。
核心亮点:
| 维度 | 详情 |
|---|---|
| 编程能力 | 6项编程基准取得最高分(SWE-bench Pro、Terminal-Bench 2.0、SkillsBench、QwenClawBench、QwenWebBench、SciCode) |
| 智能体编程 | 相比Qwen3.6-Plus,SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0 |
| 世界知识 | SuperGPQA +2.3、QwenChineseBench +5.3 |
| 指令遵循 | ToolcallFormatIFBench +2.8 |
| 可用方式 | Qwen Studio在线体验、阿里云百炼API(qwen3.6-max-preview) |
这是Qwen3.6系列的最新成员。此前Qwen3.6-Plus已登顶OpenRouter日榜、周榜、趋势榜冠军,Qwen3.6-35B-A3B开源版登顶HuggingFace全球开源大模型榜单。Qwen3.6家族正在形成从轻量到旗舰的完整产品矩阵。
为什么重要: Qwen3.6-Max-Preview在编程基准上的全面领先,标志着国产大模型在Agent/智能体编程这一关键赛道上具备了与国际顶尖模型竞争的实力。随着AI从”对话”走向”执行”,编程能力正在成为衡量大模型价值的核心指标。阿里选择以预览版形式发布,也反映出国产大模型竞争的节奏正在加快——先占位、再迭代。
来源:IT之家 - 新一代”家族旗舰”模型:阿里Qwen3.6-Max预览版发布 | 中新网 - 阿里发布Qwen3.6-Max预览版 | 凤凰网科技 - 阿里Qwen3.6-Max预览版发布:智能体编程能力优化
月之暗面Kimi K2.6发布并开源:代码能力对标GPT-5.4,Agent集群支持300子Agent并行
4月20日,月之暗面正式发布并开源旗舰模型Kimi K2.6。该模型在代码编写、长程任务执行及Agent集群协同三大核心领域实现全面升级,多项基准成绩对标甚至超越GPT-5.4、Claude Opus 4.6、Gemini 3.1 Pro等国际顶尖闭源模型。
核心能力与基准成绩:
| 基准测试 | 成绩 | 备注 |
|---|---|---|
| Humanity’s Last Exam | 54.0% | 排名第一 |
| SWE-bench Pro | 58.6% | 领先所有闭源模型 |
| DeepSearchQA | 92.5% | 大幅领先GPT-5.4、Gemini 3.1 Pro |
| Kimi Design Bench | **47.5%**胜出 | 对比Gemini 3.1 Pro(31.4%) |
三大核心升级:
| 能力 | 详情 |
|---|---|
| 长程编码 | 不间断编码最长13小时,修改超4000行代码,Kimi Code Bench较K2.5提升约20% |
| Agent集群 | 最多调度300个子Agent并行,完成4000个协作步骤,支持单次运行多产物端到端交付 |
| 自主化执行 | 支持跨应用24/7不间断运行,内部测试连续5天自主运行,Claw Bench较K2.5提升10% |
模型已在HuggingFace开源(moonshotai/Kimi-K2.6),支持262,144 Token上下文窗口。所有用户可通过kimi.com、Kimi应用、Kimi API及Kimi Code编程助手免费使用。
为什么重要: Kimi K2.6的发布标志着国产大模型在两个关键方向上实现突破:一是代码能力首次在权威基准上全面对标GPT-5.4等顶级闭源模型;二是Agent集群能力大幅升级,300子Agent并行+13小时不间断编码的能力,意味着AI正在从”辅助工具”进化为”自主工作者”。同时,月之暗面选择开源这一策略,将进一步加速国产大模型的生态建设。
来源:新浪科技 - 月之暗面最强模型Kimi K2.6发布 | 新浪科技 - 月之暗面最强模型Kimi K2.6发布并开源 | 智东西 - 杨植麟交卷!Kimi K2.6抢先开源 | 搜狐 - 开源重磅!月之暗面发布Kimi K2.6
国家自然科学基金发布”下一代AI”重大研究计划2026年度指南
国家自然科学基金委员会(NSFC)今日发布了**“可解释、可通用的下一代人工智能方法”重大研究计划2026年度项目指南**。该计划聚焦于AI领域最前沿的基础研究,旨在推动中国AI从”大规模工程应用”向”可解释、可信赖的通用智能”迈进。
为什么重要: 这一指南的发布表明中国正在系统性地布局下一代AI基础研究。与当前行业聚焦的”更大模型、更多数据”范式不同,该计划强调”可解释性”和”通用性”——这正是当前大模型最被诟病的两个短板。结合Google DeepMind近期设立”哲学家”岗位、学术界呼吁AI从”语言推理”转向”世界模型”的趋势,全球AI研究正在出现一个共识:当前的大模型范式可能需要根本性的变革。
腾讯混元3.0正式落地,2026年AI投入翻倍至超360亿元
腾讯混元大模型3.0版本已在4月正式发布并落地核心业务。今年3月公布的2025年全年财报显示,腾讯在AI领域全面提速:
| 指标 | 数据 |
|---|---|
| 2025年全年营收 | 7,518亿元(同比+14%) |
| 2025年研发投入 | 857.5亿元(创历史新高) |
| 2025年资本开支 | 792亿元 |
| 2026年AI投入预计 | 超360亿元(较2025年翻倍) |
| 混元/元宝2025年Q4投入 | 16亿元(单季度) |
混元3.0正在融入腾讯的游戏、广告和社交等核心业务线。华盛通4月15日的深度报道披露,混元团队进行了组织架构调整,由姚顺雨领导混元大语言模型部,AI Infra部门也进行了整合。总裁刘炽平将2025年财报称为”史上AI含量最高”的成绩单。
为什么重要: 腾讯的AI投入策略代表了中国互联网巨头的一条独特路径:不追求在通用大模型上超越OpenAI或Google,而是将AI深度整合到现有核心业务中(游戏、社交、广告),通过业务变现来支撑持续的AI投入。这种”业务驱动型AI”策略与OpenAI的”技术驱动型”策略形成鲜明对比。
来源:新华网 - 腾讯2025年全年业绩:混元3.0将于4月发布 | 新浪财经 - 腾讯全年研发投入858亿夯实AI底座 | 华盛通 - 腾讯AI·五问:混元的三年战争 | 华尔街见闻 - 腾讯进入AI烧钱阶段
多个大模型集体”沦陷”:AI制造谣言问题浮出水面
据证券时报报道,记者实测发现多个主流大模型在处理某些信息时产生了AI制造的谣言。不过报道也指出,腾讯旗下的元宝(DeepSeek模式)能够正确识别并指出谣言。
这一报道揭示了AI行业一个日益严峻的问题:随着AI生成内容的指数级增长,AI”幻觉”(hallucination)正在从技术缺陷演变为社会风险。当大模型以自信的语气输出错误信息时,普通用户往往难以辨别真伪。
为什么重要: AI内容可信度问题正在从”技术讨论”进入”公共议题”。这与上周Anthropic发表在《Nature》上的”潜意识传染”研究形成呼应——如果AI模型的缺陷可以在训练链中传播,那么AI生成内容的可靠性问题可能随时间恶化而非改善。
行业观察
信号一:AI推理芯片市场进入”群雄逐鹿”阶段
过去一周的AI芯片动态揭示了一个清晰趋势:AI算力的竞争焦点正在从”训练”向”推理”转移。NVIDIA通过收购Groq巩固地位,Google通过Marvell和Broadcom两条路线构建替代方案,Cerebras通过IPO募集战场资金,Anthropic通过锁定3.5GW TPU产能确保供应链安全。
这让人想起2010年代智能手机时代的芯片战争——最终赢家不是技术最强的,而是生态最完善的。NVIDIA的CUDA生态是其最大的护城河,但推理市场对软件生态的依赖度低于训练市场,这为挑战者提供了真正的机会窗口。
信号二:国产大模型”4月20日双发”,竞争白热化
4月20日一天之内,阿里Qwen3.6-Max-Preview和月之暗面Kimi K2.6同时发布,这并非巧合。两家公司选择在同一窗口期亮出旗舰产品,折射出国产大模型竞争的三个趋势:
- 编程与Agent成为新主战场:Qwen3.6-Max主打6项编程基准最高分,Kimi K2.6主打代码能力对标GPT-5.4和300子Agent集群——两家都不约而同地将”AI执行任务”而非”AI对话”作为核心卖点
- 开源成为标配竞争策略:Kimi K2.6选择开源,Qwen3.6系列已有35B-A3B开源版登顶HuggingFace——国产大模型正在用开源争夺生态
- 对标闭源顶尖成为新常态:不再是”国产模型之间的比较”,而是直接对标GPT-5.4、Claude Opus 4.6、Gemini 3.1 Pro
信号三:中国AI”两条腿走路”策略加速
一方面,DeepSeek V4搭载华为芯片标志着技术自主化路线取得实质性进展;另一方面,Qwen3.6-Max和Kimi K2.6的密集发布、国家自然科学基金的下一代AI研究计划和腾讯混元3.0的落地表明,中国在基础研究和产业应用两个维度同步推进。这种”技术自主化+基础研究+产业落地”三位一体策略,与美国的”前沿实验室主导”模式形成差异化竞争。
信号四:AI可信度成为新焦点
从Anthropic的Nature论文到今天的大模型谣言报道,AI内容的可信度正在成为行业的新焦点。这可能催生一个新市场:“AI内容验证”工具和服务。
关键要点
- Google与Marvell洽谈开发两款AI推理芯片,AI算力竞争焦点正从”训练”转向”推理”,NVIDIA垄断面临多方挑战
- DeepSeek V4预计本周发布,将成首个完全运行在华为芯片上的前沿大模型,中国AI自主化迎关键里程碑
- 阿里Qwen3.6-Max-Preview发布,登顶Artificial Analysis最佳国产模型,6项编程基准取得最高分
- 月之暗面Kimi K2.6发布并开源,Humanity’s Last Exam 54.0%第一,SWE-bench Pro 58.6%领先闭源模型,Agent集群支持300子Agent并行
- 国家自然科学基金发布下一代AI重大研究计划2026年度指南,聚焦”可解释、可通用”方向
- 腾讯混元3.0正式落地核心业务,2026年AI投入翻倍至超360亿元,“业务驱动型AI”策略加速推进
- AI制造谣言问题引发关注,大模型可信度正从技术问题升级为社会议题
常见问题
为什么AI推理芯片突然成为竞争热点?
AI产业正在经历一个根本性转变:2024-2025年,行业重心是”训练更大的模型”(一次性投入大量算力);2026年开始,随着GPT-5、Claude Opus、Gemini等模型相继成熟,行业重心转向”运行这些模型服务数十亿用户”(持续消耗算力)。推理市场的规模预计将数倍于训练市场,这就是为什么Google、NVIDIA、Cerebras等公司都在抢占这个赛道。
DeepSeek V4使用华为芯片意味着什么?
这意味着中国AI模型首次完全摆脱了对NVIDIA GPU的依赖。此前,即使是中国的AI模型也主要在NVIDIA芯片上训练和运行。如果V4成功证明华为昇腾芯片可以支撑前沿AI模型的运行,将为中国AI产业建立独立的算力供应链提供关键验证。
国家自然科学基金的下一代AI研究计划重点是什么?
该计划聚焦”可解释、可通用的下一代人工智能方法”——即让AI的决策过程可以被人类理解和验证(可解释性),以及让AI能够在不同领域灵活应用(通用性)。这与当前大模型”黑箱式”的运作方式形成鲜明对比,代表了AI基础研究的一个重要方向。
Qwen3.6-Max-Preview和Kimi K2.6的发布意味着什么?
4月20日的”双发”标志着国产大模型竞争进入新阶段。Qwen3.6-Max-Preview在编程基准上的全面领先,加上Kimi K2.6在Humanity’s Last Exam和SWE-bench Pro上的突破,意味着国产模型首次在”AI执行任务”(而非仅”AI对话”)这一关键维度上具备了与国际顶尖模型竞争的实力。同时,K2.6选择开源将进一步推动国产大模型生态发展。
近期应该关注什么?
重点关注四件事:1)DeepSeek V4是否在本周正式发布以及其实际性能表现;2)Qwen3.6-Max正式版的发布时间及与Preview版的性能差异;3)Kimi K2.6开源后社区生态的发展情况;4)4月29日微软Q3 FY2026财报中的Azure AI营收数据——这将是AI商业化变现能力的最新验证。
参考资料
- Reuters - Google in talks with Marvell to build new AI chips for inference
- Reuters - Broadcom signs long-term deal to develop Google’s custom AI chips
- Silicon Republic - Anthropic, Google, Broadcom announce 3.5GW TPU deal
- CNBC - Broadcom agrees to expanded chip deals with Google, Anthropic
- TechCrunch - Anthropic ups compute deal with Google and Broadcom
- Anthropic Blog - Expanding partnership with Google and Broadcom for compute
- Reuters - DeepSeek’s V4 model will run on Huawei chips
- TechNode - DeepSeek V4 may launch this month
- Gizchina - DeepSeek V4 expected to launch in late April
- 联合早报 - DeepSeek V4将使用华为芯片
- 国家自然科学基金委员会 - 2026年度项目指南
- 新华网 - 2026年度国家自然科学基金项目指南出炉
- 新华网 - 腾讯2025年全年业绩:混元3.0将于4月发布
- 新浪财经 - 腾讯全年研发投入858亿夯实AI底座
- 华盛通 - 腾讯AI·五问:混元的三年战争
- 华尔街见闻 - 腾讯进入AI烧钱阶段
- 证券时报 - 大模型集体”沦陷”:AI制造的谣言如何产生
- IT之家 - 新一代”家族旗舰”模型:阿里Qwen3.6-Max预览版发布
- 中新网 - 阿里发布Qwen3.6-Max预览版
- 凤凰网科技 - 阿里Qwen3.6-Max预览版发布:智能体编程能力优化
- 新浪科技 - 月之暗面最强模型Kimi K2.6发布
- 新浪科技 - 月之暗面最强模型Kimi K2.6发布并开源
- 智东西 - 杨植麟交卷!Kimi K2.6抢先开源
- 搜狐 - 开源重磅!月之暗面发布Kimi K2.6