AI 观察👀

记录、思考,but AI

刊载于

AI网络攻击能力每四个月翻倍:AISI最新评估揭示安全新纪元,奥斯卡封杀AI演员与编剧

英国AI安全研究所评估GPT-5.5网络攻击能力与Mythos持平,AI进攻能力加速翻倍引发全球安全焦虑;同日,奥斯卡官方宣布AI演员和剧本不符合参评资格,IBM Think 2026和ServiceNow Knowledge两大企业AI大会聚焦"智能体元年"。

AI 分析 网络安全 AISI Anthropic OpenAI 奥斯卡 IBM ServiceNow 智能体 行业动态 大模型

5月5日,AI行业的三条新闻从不同维度指向了同一个结论:AI正在从”辅助工具”转变为”自主行动者”——无论是在网络安全战场、企业工作流,还是在文化产业的规则制定中。

英国AI安全研究所(AISI)发布了GPT-5.5网络安全能力评估报告,确认OpenAI的最新模型在进攻性网络安全任务上的表现已与Anthropic的Claude Mythos持平。这是第二个通过32步端到端企业网络攻击模拟的前沿模型。AISI的结论令人警醒:前沿AI网络攻击能力正在每四个月翻倍——较2025年底每七个月翻倍的速度大幅加速。

同日,奥斯卡主办方美国电影艺术与科学学院宣布新规则,明确禁止AI生成的演员和剧本参与评奖——“表演必须由真人完成”、“剧本必须由人类撰写”。这是全球文化产业对AI自主创作做出的最高级别制度回应。

而在拉斯维加斯,ServiceNow Knowledge 2026大会IBM Think 2026同时开幕,两家企业软件巨头将”AI智能体(AI Agents)“定位为企业计算的下一个范式。


GPT-5.5为何让网络安全界”倒吸一口凉气”?

发生了什么

英国AI安全研究所(AISI)发布的GPT-5.5网络安全评估报告揭示了多项关键发现:

评估维度GPT-5.5表现对比模型
Expert级任务通过率71.4%Mythos 68.6%、GPT-5.4 52.4%、Opus 4.7 48.6%
32步网络攻击模拟(TLO)2/10次端到端成功Mythos 3/10次(首个通过的模型)
工业控制系统攻击未通过尚无模型通过

最令人震惊的是GPT-5.5在一个名为rust_vm的逆向工程挑战中的表现:这个任务要求攻击者从零开始逆向工程一个自定义Rust虚拟机,构建反汇编器,破解认证程序,并用SMT求解器恢复密码。人类专家使用Binary Ninja、gdb、Python和Z3耗时约12小时完成。GPT-5.5用了10分22秒,花费1.73美元。

AISI的关键结论是:网络攻击能力不再是某个模型的”特长”,而是前沿AI通用能力提升的自然副产品。 如果进攻性网络技能是长期自主推理和编程能力提升的”附带产物”,那么未来每一代模型都会自动获得更强的网络攻击能力。

速度在加快:从七个月到四个月

AISI现在估计,前沿AI网络攻击能力正在每四个月翻倍。2025年底,这一速度还是每七个月翻倍。加速的原因很清晰——不是安全工具变得更弱,而是模型的通用推理、自主规划和代码能力在快速提升。

AISI在评估中还发现了一个通用越狱(universal jailbreak):仅用六小时的专家红队测试就开发出了一种攻击方法,可以绕过GPT-5.5所有的恶意网络查询防护——包括多轮对话场景。OpenAI随后更新了安全堆栈,但AISI因配置问题未能验证最终版本的有效性。

为什么这很重要?

第一,“AI进攻时代”已经到来,不再是假设。 两家不同公司(Anthropic和OpenAI)的前沿模型在一个月内先后通过了同一套32步企业网络攻击模拟。这意味着这不是某款产品的特殊能力,而是整个AI行业能力曲线的系统性提升。

第二,速度本身构成了新的威胁。 每四个月翻倍的攻击能力增长速度,意味着企业现有安全基础设施的”保质期”正在急剧缩短。传统基于签名和规则的安全工具正面临生存危机——它们的”护城河”正在被AI进攻能力的指数级增长速度甩在后面。

第三,防守者也在加速。 英国NCSC负责人Richard Horne在CyberUK大会上呼吁:不要恐惧AI攻击,而是要确保基本的网络安全措施到位。英国政府同日发布了年度网络安全泄露调查,显示过去12个月有43%的英国企业遭受了网络攻击。

历史上类似的情况

2017年WannaCry勒索病毒全球爆发:当时一个漏洞利用工具(EternalBlue)被泄露后在几天内感染了150个国家的20万台电脑。GPT-5.5级别的AI攻击能力意味着未来不需要漏洞工具泄露——AI可以自主发现并利用漏洞,且速度远超人类。WannaCry是”一次性的”,AI驱动的攻击将是”持续性的”。

2010年Stuxnet震网病毒:被认为是首个针对工业控制系统的网络武器,由国家级团队耗时数年开发。AISI的Cooling Tower工业控制系统攻击模拟目前尚无模型通过——但如果”每四个月翻倍”的速度持续,这个门槛被突破可能只是时间问题。


奥斯卡为何”画下红线”禁止AI演员和编剧?

发生了什么

美国电影艺术与科学学院5月2日宣布了针对2027年奥斯卡奖的新规则:

  • 表演类奖项:只有”经法律认可并由真人实际完成的表演”才有资格参评——AI生成的虚拟演员不具备参评资格
  • 编剧类奖项:剧本必须是”人类创作的”(human-authored)——AI生成的剧本无法参赛
  • 辅助使用AI:规则同时声明,使用生成式AI工具”既不会帮助也不会损害”影片获得提名的机会

这一规则变化的背景是2026年初Tropic Thunder风格的”Norwood”虚拟演员事件引发的行业争论——当时有电影尝试使用AI生成的虚拟角色参演,引发了工会和创作者的强烈反弹。

为什么这很重要?

这是全球文化机构首次在制度层面对AI创作划定明确边界。 此前的讨论主要集中在版权和伦理层面,但奥斯卡的新规则将争议从”能不能做”推进到了”做了算不算”——即使技术上可行,AI生成的表演和剧本在最高的艺术评价体系中不被认可。

但规则的灰色地带仍然巨大。 “使用AI不会帮助也不会损害提名机会”的表述,实质上承认了AI辅助工具在电影制作中的合法性——只是AI不能替代人类成为”创作者”。这条线的划分在未来将变得越来越困难:导演用AI辅助调色算不算”辅助”?编剧用AI生成初稿再人工修改算不算”人类创作”?

历史上类似的情况

1927年有声电影取代默片的”Jazz Singer时刻”:当有声电影技术出现时,许多默片时代的演员和导演将其视为对”纯粹电影艺术”的威胁。奥斯卡最终设立了对有声电影的完整评奖体系。AI在电影中的角色可能类似——最初被视为”入侵者”,但最终可能被纳入主流创作工具箱,只是需要在制度上明确边界。


IBM和ServiceNow为何同时押注”企业AI智能体”?

发生了什么

5月5日,两场聚焦企业AI的重要会议同时开幕:

IBM Think 2026(波士顿/线上):CEO Arvind Krishna在开幕主旨演讲中阐述了AI与量子计算如何定义企业未来。IBM的战略核心是”开放式小型模型”——通过可完全在企业自有基础设施上运行的轻量级AI模型,解决数据主权和隐私顾虑。会前公告包括与赛车制造商Dallara的合作(用量子计算+AI优化高性能车辆设计),以及一项显示CEO们正在加速AI战略调整的全球研究。

ServiceNow Knowledge 2026(拉斯维加斯,5月5-7日):大会主题是”AI Agents Take Center Stage”。ServiceNow预计将发布一系列新产品,包括AI Agents(自主AI智能体)、Agent Studio(智能体构建工具)、AI Control Tower(智能体治理平台)和RaptorDB(新数据库技术)。大会计划超过1000场分会,吸引了数千名企业IT决策者。

为什么这很重要?

“企业AI智能体”正在从概念验证走向产品化。 2025年的企业AI讨论集中在”copilot”——辅助人类工作的工具。2026年的主题已经转向”agent”——自主执行任务的AI。ServiceNow的AI Control Tower概念尤其值得关注:它暗示企业将需要一个全新的治理层来管理大量自主运行的AI智能体。

IBM的”小型开放模型”战略代表了AI行业的一条分叉路。 与OpenAI、Anthropic追求越来越大的前沿模型不同,IBM主张企业需要的不是最聪明的模型,而是可以在自己数据中心运行、自己控制数据的模型。这条路径是否能与前沿大模型竞争,是2026年企业AI市场最大的问题之一。


行业趋势

趋势一:AI安全正在从”模型安全”转向”系统安全”

AISI的GPT-5.5评估与此前Mythos评估的连续性表明,AI安全讨论的焦点正在从”单个模型有没有危险”转向”整个AI生态系统的安全性如何”。越狱测试、未经授权访问、第三方供应商泄露——BBC报道的Mythos未授权访问事件揭示了AI安全的真正薄弱环节不在模型本身,而在围绕模型的分发和访问控制体系。

趋势二:AI与人类创造力的”制度性分界”正在形成

奥斯卡的AI禁令不是孤例——如昨日报道所述,五角大楼将Anthropic标记为”供应链风险”也是制度性分界的一种体现。不同的是,奥斯卡的边界旨在保护人类创作者的不可替代性,而军事AI的边界则围绕”谁能使用”和”怎么使用”。两条线的同时出现表明:社会对AI的治理正在从技术层面向制度层面加速过渡。


其他值得关注的消息

Anthropic调查Mythos未授权访问事件

如趋势一中所述,BBC报道了Claude Mythos的未授权访问事件。彭博社补充报道称,一群用户在私人论坛上通过第三方供应商环境获取了模型权限。Anthropic表示”没有证据表明我们的系统受到影响”,但事件引发了关于AI公司是否有能力阻止先进模型落入不当之手的严重质疑。

xAI全部11位联合创始人已离职

The Next Web报道,Elon Musk的AI公司xAI的全部11位原始联合创始人均已离开。最后两位离开的是Manuel Kroiss和Ross Nordeen。Musk在X上将此描述为公司”重组以提高速度”。这一消息发生在xAI与SpaceX合并的背景下——SpaceX计划今年夏天IPO,而xAI的核心技术人才流失可能影响其竞争地位。

Oracle裁员3万人为AI建设让路

TIME杂志深度报道揭示了Oracle裁员3万人的细节——这是该公司48年历史上最大规模的裁员。与此同时,Oracle公布了创纪录的收入和5530亿美元的订单积压。裁员释放的80-100亿美元现金流将全部投入AI基础设施建设。这一模式——用传统业务的人力和资金为AI让路——正在科技行业蔓延(如前日报道,Meta也计划在5月20日启动第一波裁员)。

Morgan Stanley:AI可为游戏行业带来220亿美元利润增量

据Reuters报道,Morgan Stanley分析师预计先进AI工具可以将游戏开发成本削减近50%,为行业每年增加约220亿美元利润。EA将于今日盘后发布财报,该公司CEO此前透露85%的质检工作已由AI完成。


关键要点

  • GPT-5.5通过了32步企业网络攻击模拟,与Mythos并列成为最强的AI网络攻击能力模型。AISI评估前沿AI网络攻击能力正在每四个月翻倍——从2025年底的七个月翻倍大幅加速
  • GPT-5.5在10分22秒内解决了人类专家需要12小时的逆向工程挑战,花费仅1.73美元——这不仅是速度提升,更是”能力民主化”的标志
  • 奥斯卡禁止AI演员和剧本参评——全球文化机构首次在制度层面明确AI不能替代人类成为”创作者”
  • IBM Think和ServiceNow Knowledge同时聚焦企业AI智能体——2026年企业AI的主题已从”copilot辅助”转向”agent自主执行”
  • xAI全部联合创始人离职、Oracle裁员3万人——AI行业的人才和资本正在经历剧烈的结构性重组

常见问题

AI网络攻击能力每四个月翻倍意味着什么?

这意味着如果你今天的安全防御能够抵御AI攻击,四个月后可能就不够了。对于企业来说,传统的年度安全审计和季度渗透测试的节奏已经跟不上AI攻击能力的进化速度。安全团队需要建立持续的AI驱动的防御体系,而不是周期性的人工检查。

GPT-5.5的10分钟破解是否说明所有网络安全防线都失效了?

不是。AISI的评估有两个重要限定条件:一是在没有活跃防御者的环境中进行的;二是基于已知漏洞的攻击。但关键在于——今天没有防御者的测试环境,可能就是明天有防御者的真实场景。AISI正在构建包含防御者和告警机制的新测试环境,结果将在今年晚些时候公布。

奥斯卡禁止AI是否会影响电影行业使用AI的意愿?

影响有限。奥斯卡规则明确说”使用AI既不会帮助也不会损害提名机会”——这意味着视觉效果、剪辑、音效等环节仍然可以自由使用AI工具。禁令只针对”AI替代人类成为演员或编剧”这一极端场景。大多数电影制作公司会继续在制作流程中广泛采用AI,只是在最终的艺术署名上保持”人类标签”。

什么是”企业AI智能体”,它和ChatGPT有什么区别?

ChatGPT等工具是”copilot”——你问它答,它建议你执行。企业AI智能体是”agent”——你给它目标,它自主规划、执行并完成任务。例如,ServiceNow的AI智能体可以自主处理IT工单、协调多个系统完成故障修复,而不需要人类逐步指示。这代表了AI从”工具”到”员工”的转变。

接下来应该关注什么?

重点关注三个方向:一是AISI何时发布包含活跃防御者的新一代网络攻击测试结果——这将更准确地反映真实世界威胁;二是ServiceNow和IBM本周的产品发布能否真正将”AI智能体”从概念推向生产环境;三是NVIDIA 5月20日的Q1 FY2027财报——它将揭示7250亿美元AI capex中有多少实际转化为GPU订单。


参考资料