AI 观察👀

记录、思考,but AI

刊载于

AI行业简报 2026-04-21

Google与Marvell洽谈开发AI推理芯片直击NVIDIA软肋、DeepSeek V4预计本周发布首次搭载华为芯片、阿里Qwen3.6-Max-Preview登顶最佳国产模型、月之暗面Kimi K2.6发布并开源对标GPT-5.4、国家自然科学基金发布下一代AI重大研究计划、腾讯混元3.0正式落地。今日AI行业动态汇总。

AI 简报 行业动态

AI行业简报 2026-04-21

周一开盘,AI行业迎来一个”国产大模型日”——4月20日一天之内,阿里和月之暗面同时发布新一代旗舰模型。阿里Qwen3.6-Max-Preview正式发布,在Artificial Analysis榜单登顶”最佳国产模型”,6项编程基准取得最高分;月之暗面Kimi K2.6发布并开源,在Humanity’s Last Exam得分54.0%排名第一、SWE-bench Pro 58.6%领先所有闭源模型,Agent集群能力全面升级。此外,Google正与Marvell洽谈开发两款全新AI推理芯片,目标直指NVIDIA垄断地位;DeepSeek V4预计本周发布,将是首个完全运行在华为芯片上的前沿大模型;国内层面,国家自然科学基金委发布下一代AI重大研究计划2026年度指南,腾讯混元3.0正式落地核心业务。以下是今日AI行业动态汇总。


今日要闻

Google与Marvell洽谈开发AI推理芯片,AI算力战场从”训练”转向”推理”

据Reuters 4月19日报道,Alphabet旗下Google正与芯片设计公司Marvell Technology洽谈,合作开发两款全新的AI推理芯片。这两款芯片旨在更高效地运行已训练好的AI模型——即”推理”(inference)环节,而非”训练”(training)环节。

背景:AI推理市场正在成为新的主战场

这一消息并非孤立事件,而是AI芯片竞争格局深刻变化的最新信号:

事件时间涉及方
NVIDIA以$170-200亿收购推理芯片公司Groq2026年3月NVIDIA
Broadcom与Google签署长期TPU协议(至2031年)2026年4月6日Broadcom, Google
Anthropic与Google/Broadcom签署3.5GW TPU算力协议2026年4月7日Anthropic, Google, Broadcom
Cerebras提交$230亿IPO申请,主攻推理市场2026年4月17日Cerebras, OpenAI
Google与Marvell洽谈开发推理芯片2026年4月19日Google, Marvell

这一系列布局的共同指向是:AI产业的重心正从”训练模型”向”运行推理”转移。随着GPT-5、Claude Opus、Gemini等前沿模型相继成熟,AI公司需要的海量计算资源正在从”训练一次性投入”转向”推理持续消耗”。分析师预计,推理市场规模将数倍于训练市场。

为什么重要: NVIDIA在AI训练芯片市场的份额超过80%,但推理市场格局尚未定型。Google选择与Marvell合作(而非自研),说明即使是Google这样的技术巨头,也在寻求更快的产品上市路径。如果Google-Mavrell合作成功,加上NVIDIA的Groq收购、Cerebras的IPO和Broadcom的TPU协议,2026年下半年AI推理芯片市场将迎来前所未有的竞争。

来源:Reuters - Google in talks with Marvell to build new AI chips | Reuters - Broadcom signs long-term deal to develop Google’s custom AI chips | Silicon Republic - Anthropic, Google, Broadcom announce 3.5GW TPU deal | CNBC - Broadcom agrees to expanded chip deals with Google, Anthropic


DeepSeek V4预计本周发布:首个搭载华为芯片的前沿大模型

自4月初Reuters首次报道DeepSeek V4将使用华为芯片运行以来,市场一直高度关注其发布时间。据多家媒体报道,V4预计将在4月下旬(本周)正式发布

已知信息汇总:

维度详情
参数规模约1万亿参数,370亿活跃参数(MoE架构)
上下文窗口预计支持100万Token
模态多模态(文本、图像、视频)
测试模式已发现”Vision”和”Expert”模式
硬件华为昇腾(Ascend)AI芯片
基准成绩SWE-bench 81%(软件工程)
核心突破首个完全运行在国产芯片上的前沿AI模型

此前报道指出,DeepSeek此次一反常态,没有向NVIDIA和AMD提供早期版本进行性能调优,而是优先向华为等国产芯片供应商提供准备。这一决策背后的战略意图不言而喻:证明中国AI生态可以在没有NVIDIA的情况下运行最前沿的模型。

为什么重要: 如果V4在本周发布并确认使用华为芯片运行,这将是中国AI自主化的一个标志性事件。它将向全球证明:即使没有NVIDIA最先进的GPU,中国也能训练和运行世界级AI模型。这对全球AI芯片格局和中美科技竞争都将产生深远影响。

来源:Reuters - DeepSeek’s V4 model will run on Huawei chips | TechNode - DeepSeek V4 may launch this month | Gizchina - DeepSeek V4 expected to launch in late April | 联合早报 - DeepSeek V4将使用华为芯片


阿里Qwen3.6-Max-Preview发布:登顶Artificial Analysis最佳国产模型

4月20日下午,阿里正式发布Qwen3.6-Max-Preview——Qwen系列新一代旗舰模型的早期预览版。该模型在权威第三方评测榜单Artificial Analysis上登顶”最佳国产模型”,性能表现超过GLM5.1、MiniMax-M2.7等模型。

核心亮点:

维度详情
编程能力6项编程基准取得最高分(SWE-bench Pro、Terminal-Bench 2.0、SkillsBench、QwenClawBench、QwenWebBench、SciCode)
智能体编程相比Qwen3.6-Plus,SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0
世界知识SuperGPQA +2.3、QwenChineseBench +5.3
指令遵循ToolcallFormatIFBench +2.8
可用方式Qwen Studio在线体验、阿里云百炼API(qwen3.6-max-preview)

这是Qwen3.6系列的最新成员。此前Qwen3.6-Plus已登顶OpenRouter日榜、周榜、趋势榜冠军,Qwen3.6-35B-A3B开源版登顶HuggingFace全球开源大模型榜单。Qwen3.6家族正在形成从轻量到旗舰的完整产品矩阵。

为什么重要: Qwen3.6-Max-Preview在编程基准上的全面领先,标志着国产大模型在Agent/智能体编程这一关键赛道上具备了与国际顶尖模型竞争的实力。随着AI从”对话”走向”执行”,编程能力正在成为衡量大模型价值的核心指标。阿里选择以预览版形式发布,也反映出国产大模型竞争的节奏正在加快——先占位、再迭代。

来源:IT之家 - 新一代”家族旗舰”模型:阿里Qwen3.6-Max预览版发布 | 中新网 - 阿里发布Qwen3.6-Max预览版 | 凤凰网科技 - 阿里Qwen3.6-Max预览版发布:智能体编程能力优化


月之暗面Kimi K2.6发布并开源:代码能力对标GPT-5.4,Agent集群支持300子Agent并行

4月20日,月之暗面正式发布并开源旗舰模型Kimi K2.6。该模型在代码编写、长程任务执行及Agent集群协同三大核心领域实现全面升级,多项基准成绩对标甚至超越GPT-5.4、Claude Opus 4.6、Gemini 3.1 Pro等国际顶尖闭源模型。

核心能力与基准成绩:

基准测试成绩备注
Humanity’s Last Exam54.0%排名第一
SWE-bench Pro58.6%领先所有闭源模型
DeepSearchQA92.5%大幅领先GPT-5.4、Gemini 3.1 Pro
Kimi Design Bench**47.5%**胜出对比Gemini 3.1 Pro(31.4%)

三大核心升级:

能力详情
长程编码不间断编码最长13小时,修改超4000行代码,Kimi Code Bench较K2.5提升约20%
Agent集群最多调度300个子Agent并行,完成4000个协作步骤,支持单次运行多产物端到端交付
自主化执行支持跨应用24/7不间断运行,内部测试连续5天自主运行,Claw Bench较K2.5提升10%

模型已在HuggingFace开源(moonshotai/Kimi-K2.6),支持262,144 Token上下文窗口。所有用户可通过kimi.com、Kimi应用、Kimi API及Kimi Code编程助手免费使用。

为什么重要: Kimi K2.6的发布标志着国产大模型在两个关键方向上实现突破:一是代码能力首次在权威基准上全面对标GPT-5.4等顶级闭源模型;二是Agent集群能力大幅升级,300子Agent并行+13小时不间断编码的能力,意味着AI正在从”辅助工具”进化为”自主工作者”。同时,月之暗面选择开源这一策略,将进一步加速国产大模型的生态建设。

来源:新浪科技 - 月之暗面最强模型Kimi K2.6发布 | 新浪科技 - 月之暗面最强模型Kimi K2.6发布并开源 | 智东西 - 杨植麟交卷!Kimi K2.6抢先开源 | 搜狐 - 开源重磅!月之暗面发布Kimi K2.6


国家自然科学基金发布”下一代AI”重大研究计划2026年度指南

国家自然科学基金委员会(NSFC)今日发布了**“可解释、可通用的下一代人工智能方法”重大研究计划2026年度项目指南**。该计划聚焦于AI领域最前沿的基础研究,旨在推动中国AI从”大规模工程应用”向”可解释、可信赖的通用智能”迈进。

为什么重要: 这一指南的发布表明中国正在系统性地布局下一代AI基础研究。与当前行业聚焦的”更大模型、更多数据”范式不同,该计划强调”可解释性”和”通用性”——这正是当前大模型最被诟病的两个短板。结合Google DeepMind近期设立”哲学家”岗位、学术界呼吁AI从”语言推理”转向”世界模型”的趋势,全球AI研究正在出现一个共识:当前的大模型范式可能需要根本性的变革。

来源:国家自然科学基金委员会 - 2026年度项目指南 | 新华网 - 2026年度国家自然科学基金项目指南出炉


腾讯混元3.0正式落地,2026年AI投入翻倍至超360亿元

腾讯混元大模型3.0版本已在4月正式发布并落地核心业务。今年3月公布的2025年全年财报显示,腾讯在AI领域全面提速:

指标数据
2025年全年营收7,518亿元(同比+14%)
2025年研发投入857.5亿元(创历史新高)
2025年资本开支792亿元
2026年AI投入预计超360亿元(较2025年翻倍)
混元/元宝2025年Q4投入16亿元(单季度)

混元3.0正在融入腾讯的游戏、广告和社交等核心业务线。华盛通4月15日的深度报道披露,混元团队进行了组织架构调整,由姚顺雨领导混元大语言模型部,AI Infra部门也进行了整合。总裁刘炽平将2025年财报称为”史上AI含量最高”的成绩单。

为什么重要: 腾讯的AI投入策略代表了中国互联网巨头的一条独特路径:不追求在通用大模型上超越OpenAI或Google,而是将AI深度整合到现有核心业务中(游戏、社交、广告),通过业务变现来支撑持续的AI投入。这种”业务驱动型AI”策略与OpenAI的”技术驱动型”策略形成鲜明对比。

来源:新华网 - 腾讯2025年全年业绩:混元3.0将于4月发布 | 新浪财经 - 腾讯全年研发投入858亿夯实AI底座 | 华盛通 - 腾讯AI·五问:混元的三年战争 | 华尔街见闻 - 腾讯进入AI烧钱阶段


多个大模型集体”沦陷”:AI制造谣言问题浮出水面

据证券时报报道,记者实测发现多个主流大模型在处理某些信息时产生了AI制造的谣言。不过报道也指出,腾讯旗下的元宝(DeepSeek模式)能够正确识别并指出谣言。

这一报道揭示了AI行业一个日益严峻的问题:随着AI生成内容的指数级增长,AI”幻觉”(hallucination)正在从技术缺陷演变为社会风险。当大模型以自信的语气输出错误信息时,普通用户往往难以辨别真伪。

为什么重要: AI内容可信度问题正在从”技术讨论”进入”公共议题”。这与上周Anthropic发表在《Nature》上的”潜意识传染”研究形成呼应——如果AI模型的缺陷可以在训练链中传播,那么AI生成内容的可靠性问题可能随时间恶化而非改善。

来源:证券时报 - 大模型集体”沦陷”:AI制造的谣言如何产生


行业观察

信号一:AI推理芯片市场进入”群雄逐鹿”阶段

过去一周的AI芯片动态揭示了一个清晰趋势:AI算力的竞争焦点正在从”训练”向”推理”转移。NVIDIA通过收购Groq巩固地位,Google通过Marvell和Broadcom两条路线构建替代方案,Cerebras通过IPO募集战场资金,Anthropic通过锁定3.5GW TPU产能确保供应链安全。

这让人想起2010年代智能手机时代的芯片战争——最终赢家不是技术最强的,而是生态最完善的。NVIDIA的CUDA生态是其最大的护城河,但推理市场对软件生态的依赖度低于训练市场,这为挑战者提供了真正的机会窗口。

信号二:国产大模型”4月20日双发”,竞争白热化

4月20日一天之内,阿里Qwen3.6-Max-Preview和月之暗面Kimi K2.6同时发布,这并非巧合。两家公司选择在同一窗口期亮出旗舰产品,折射出国产大模型竞争的三个趋势:

  1. 编程与Agent成为新主战场:Qwen3.6-Max主打6项编程基准最高分,Kimi K2.6主打代码能力对标GPT-5.4和300子Agent集群——两家都不约而同地将”AI执行任务”而非”AI对话”作为核心卖点
  2. 开源成为标配竞争策略:Kimi K2.6选择开源,Qwen3.6系列已有35B-A3B开源版登顶HuggingFace——国产大模型正在用开源争夺生态
  3. 对标闭源顶尖成为新常态:不再是”国产模型之间的比较”,而是直接对标GPT-5.4、Claude Opus 4.6、Gemini 3.1 Pro

信号三:中国AI”两条腿走路”策略加速

一方面,DeepSeek V4搭载华为芯片标志着技术自主化路线取得实质性进展;另一方面,Qwen3.6-Max和Kimi K2.6的密集发布、国家自然科学基金的下一代AI研究计划和腾讯混元3.0的落地表明,中国在基础研究产业应用两个维度同步推进。这种”技术自主化+基础研究+产业落地”三位一体策略,与美国的”前沿实验室主导”模式形成差异化竞争。

信号四:AI可信度成为新焦点

从Anthropic的Nature论文到今天的大模型谣言报道,AI内容的可信度正在成为行业的新焦点。这可能催生一个新市场:“AI内容验证”工具和服务。


关键要点

  • Google与Marvell洽谈开发两款AI推理芯片,AI算力竞争焦点正从”训练”转向”推理”,NVIDIA垄断面临多方挑战
  • DeepSeek V4预计本周发布,将成首个完全运行在华为芯片上的前沿大模型,中国AI自主化迎关键里程碑
  • 阿里Qwen3.6-Max-Preview发布,登顶Artificial Analysis最佳国产模型,6项编程基准取得最高分
  • 月之暗面Kimi K2.6发布并开源,Humanity’s Last Exam 54.0%第一,SWE-bench Pro 58.6%领先闭源模型,Agent集群支持300子Agent并行
  • 国家自然科学基金发布下一代AI重大研究计划2026年度指南,聚焦”可解释、可通用”方向
  • 腾讯混元3.0正式落地核心业务,2026年AI投入翻倍至超360亿元,“业务驱动型AI”策略加速推进
  • AI制造谣言问题引发关注,大模型可信度正从技术问题升级为社会议题

常见问题

为什么AI推理芯片突然成为竞争热点?

AI产业正在经历一个根本性转变:2024-2025年,行业重心是”训练更大的模型”(一次性投入大量算力);2026年开始,随着GPT-5、Claude Opus、Gemini等模型相继成熟,行业重心转向”运行这些模型服务数十亿用户”(持续消耗算力)。推理市场的规模预计将数倍于训练市场,这就是为什么Google、NVIDIA、Cerebras等公司都在抢占这个赛道。

DeepSeek V4使用华为芯片意味着什么?

这意味着中国AI模型首次完全摆脱了对NVIDIA GPU的依赖。此前,即使是中国的AI模型也主要在NVIDIA芯片上训练和运行。如果V4成功证明华为昇腾芯片可以支撑前沿AI模型的运行,将为中国AI产业建立独立的算力供应链提供关键验证。

国家自然科学基金的下一代AI研究计划重点是什么?

该计划聚焦”可解释、可通用的下一代人工智能方法”——即让AI的决策过程可以被人类理解和验证(可解释性),以及让AI能够在不同领域灵活应用(通用性)。这与当前大模型”黑箱式”的运作方式形成鲜明对比,代表了AI基础研究的一个重要方向。

Qwen3.6-Max-Preview和Kimi K2.6的发布意味着什么?

4月20日的”双发”标志着国产大模型竞争进入新阶段。Qwen3.6-Max-Preview在编程基准上的全面领先,加上Kimi K2.6在Humanity’s Last Exam和SWE-bench Pro上的突破,意味着国产模型首次在”AI执行任务”(而非仅”AI对话”)这一关键维度上具备了与国际顶尖模型竞争的实力。同时,K2.6选择开源将进一步推动国产大模型生态发展。

近期应该关注什么?

重点关注四件事:1)DeepSeek V4是否在本周正式发布以及其实际性能表现;2)Qwen3.6-Max正式版的发布时间及与Preview版的性能差异;3)Kimi K2.6开源后社区生态的发展情况;4)4月29日微软Q3 FY2026财报中的Azure AI营收数据——这将是AI商业化变现能力的最新验证。


参考资料