DeepSeek V4深度分析:百万Token上下文如何重塑开源AI格局
DeepSeek V4正式发布Pro和Flash双版本,以1.6T/284B参数、百万Token上下文窗口和MIT开源协议,在代码和推理基准上跻身全球顶尖水平。搭载华为昇腾芯片、寒武纪原生适配,标志着中国AI全栈自主化迈入关键阶段。
共有 5 篇文章属于此标签
DeepSeek V4正式发布Pro和Flash双版本,以1.6T/284B参数、百万Token上下文窗口和MIT开源协议,在代码和推理基准上跻身全球顶尖水平。搭载华为昇腾芯片、寒武纪原生适配,标志着中国AI全栈自主化迈入关键阶段。
Anthropic 的 Claude Code 因 npm 包中包含完整 source map 文件,导致约 1900 个 TypeScript 源文件、51.2 万行代码泄露,揭示了 8 个未发布功能和内部模型代号。
2026年3月5日,OpenAI发布GPT-5.4,首次在单一模型中整合推理、编程、计算机操控、网页搜索和百万Token上下文能力。本文深入分析其核心突破、技术创新、竞争格局及对企业AI应用的深远影响。
谷歌于2026年2月19日发布Gemini 3.1 Pro,在ARC-AGI-2推理基准测试中从31.1%跃升至77.1%,实现推理性能翻倍突破。这是Gemini系列首次采用.1版本号,标志着谷歌迭代策略的重大转变。16项基准测试中12项第一,定价与前代持平,彰显谷歌在AI竞争中的"性能普惠"新战略。
阿里巴巴发布Qwen3.5-397B-A17B模型,在视觉-语言理解、智能体能力和多语言支持上取得突破性进展,首次实现26万token原生上下文与201种语言支持,标志着中美AI竞争进入全新阶段。