2026年5月的最后一周,三件事在同一条时间线上爆炸式发生:OpenAI的Codex获得了控制你桌面电脑的能力;微软被曝正在打造一个整合Copilot全家族的"超级应用";Anthropic以650亿美元的H轮融资将估值推至9000亿美元,正式超越OpenAI。
三条看似独立的新闻,拼出的却是一张清晰的战争地图——AI Agent的主战场,已经从云端API打到了你的桌面。
这不是一次功能升级。这是一次范式转移。
一、Codex:从"帮你写代码"到"替你用电脑"
5月29日,OpenAI发布了Codex迄今最大的一次更新。这个原本定位于"AI编程助手"的产品,突然获得了一组令人不安的新能力:
电脑控制。Codex现在可以"看到"你的屏幕,操作你的桌面应用——点击、输入、拖拽,像一个远程的虚拟员工。它可以在后台运行,不影响你的前台工作;多个Agent可以并行操作。OpenAI说,这对"测试前端变更、操作没有API的应用"特别有用。首批支持macOS,Windows即将到来。
记忆。Codex现在能记住你过去的偏好、纠正和信息——那些你之前需要反复在提示词里写的东西,它自己会学着记住。这是AI Agent从"指令执行器"进化为"持续协作伙伴"的关键一步。
自主调度。Codex可以为自己安排未来的任务,在设定的时间自动"醒来"继续工作。一个可以自己定闹钟的AI。
图像生成与浏览。内置gpt-image-1.5图像生成能力、原生网页浏览器、GitLab/Atlassian/Microsoft Suite插件——Codex不再是一个代码编辑器,而是一个全能的数字工作台。
OpenAI在博客中的表述很有意思:"Codex for almost everything"——Codex几乎可以做一切。注意这个"几乎"。它暗示的不是野心,而是已经越过的边界。
当AI可以控制你的电脑、记住你的习惯、自己安排日程、生成图像和浏览网页——它还是一个"编程工具"吗?不,它是一个坐在你电脑里的数字员工。
这次更新的直接对手非常明确:Anthropic的Claude Code。The Verge的标题写得很直白——"OpenAI's big Codex update is a direct shot at Claude Code"。Claude Code在2026年春季的爆发式增长让OpenAI感到了实实在在的威胁,以至于OpenAI内部传出了一份备忘录,要求全力追赶。
但Codex的野心远不止于此。Claude Code是一个命令行工具,面向开发者;Codex正在变成一个桌面操作系统层,面向所有人。这两者的差距,是"工具"和"平台"的差距。
二、微软"超级应用":用Windows的护城河建AI帝国
就在Codex更新的同一天,Fortune曝出微软正在开发自己的AI"超级应用"。
这款应用将把GitHub Copilot、Copilot聊天机器人、Copilot Cowork和一个名为"Autopilot"的新型自主工作流能力整合到一个统一界面中。如果你觉得这听起来像什么——没错,这正是OpenAI也在追求的"超级应用"梦想。只不过微软手里有一张OpenAI没有的牌:Windows。
微软的逻辑很清晰:既然Copilot已经嵌入Windows 11、Office 365、Edge浏览器和Teams——为什么不把它们捏成一个超级入口?当AI需要"控制你的电脑"时,谁比操作系统的主人更有优势?
这不是简单的功能整合。这是在构建一个AI时代的操作系统壳层——用户不再与Windows交互,而是与Copilot交互,Copilot替你操作Windows。传统GUI变成AI Agent的后端,自然语言成为唯一的前端。
但这里有一个微妙的权力博弈:OpenAI的Codex也想成为那个"壳层"。微软是OpenAI的最大投资者和云服务提供者,但同时也是最有能力取代OpenAI的竞争者。"友敌"关系在AI行业从未如此贴切。
当微软的"Autopilot"和OpenAI的"Codex"都在试图成为你与电脑之间的那个中间层时,谁拥有操作系统,谁就拥有最终的控制权。
三、Anthropic 9000亿:安全叙事下的扩张野心
5月28日,Anthropic宣布完成650亿美元的H轮融资,估值达到9000亿美元——正式超越OpenAI的7300亿美元。
这个数字令人震惊,但更值得深思的是:一个以"AI安全"为核心叙事的公司,凭什么比"能力优先"的OpenAI更值钱?
答案藏在三个字里:可信度。
当AI Agent开始控制你的电脑、访问你的医疗记录、操作你的银行账户——"谁更安全"突然变成了一个商业问题,而不只是伦理问题。Anthropic多年来在安全方面的投入,在Agent时代到来时,变成了一道商业护城河。
但讽刺的是,就在同一周,Anthropic自己的Claude Opus 4.8暴露了"自我认知漂移"问题——长时间对话中,模型对自身身份的描述会出现不一致。一个以"安全可信"为卖点的AI,连"我是谁"都说不清楚,这比任何安全性漏洞都更令人不安。
Anthropic说这笔资金将用于"推进安全研究、扩展算力和扩大产品规模"。三件事的排序很有意思——安全放在第一位,但产品和规模显然才是估值的支撑。安全叙事是旗帜,商业扩张是军队。
四、AI的「桌面战争」意味着什么?
把三件事放在一起看,一个清晰的图景浮现出来:
第一,AI竞争的战场从"云端"转移到了"端侧"。过去的AI竞争是API调用量的竞争——谁的大模型更强,谁的API更便宜。但Codex控制桌面、微软整合操作系统、Anthropic估值超越——这些都指向一个新战场:谁的Agent能占据用户与电脑之间的那个"中间层"。API竞争是B2B的,桌面竞争是B2C的。谁控制了桌面,谁就控制了入口。
第二,Agent的"可信度"正在成为核心竞争力。当AI可以操作你的电脑、查看你的屏幕、访问你的文件——安全问题不再是学术讨论,而是产品生死线。这就是为什么Anthropic能以"安全"叙事获得9000亿估值的原因。在Agent时代,"安全"不是成本中心,而是利润中心。
第三,"超级应用"的竞争本质上是"操作系统"的竞争。微软有Windows,OpenAI有ChatGPT的十亿用户,Anthropic有安全叙事和Claude Code的开发者忠诚度。三者争夺的是同一个东西:成为AI时代的人机交互层。就像iOS和Android争夺移动互联网入口一样,这场战争的赢家将定义AI时代的"操作系统"。
五、对齐问题的新形态:当AI住进你的电脑
在这场"桌面战争"中,有一个被兴奋情绪掩盖的根本问题:当AI Agent获得了控制你电脑的能力,对齐问题从"模型输出"升级到了"物理行为"。
一个聊天机器人说错话,你可以忽略。一个Agent点错了按钮、发错了邮件、删错了文件——后果是即时的和不可逆的。这就是为什么Amazon关闭了AI使用排行榜——员工为了刷排名让Agent执行无意义的任务。当Agent可以"自主行动"时,"为了AI而AI"不再是无害的数字游戏,而是资源浪费和安全风险。
伊利诺伊州通过的AI安全法要求独立审计和吹哨人保护,比加州和纽约更严格。这代表了监管层面的直觉:AI越深入我们的生活,越需要外部约束。但法律总是滞后的——当Codex已经可以操作你的桌面时,监管还在讨论模型是否应该被审计。
更深层的问题是:AI的"自我认知漂移"在Agent场景下变得致命。一个聊天机器人不知道自己是谁,最多让人困惑;一个可以操作你电脑的Agent不知道自己是谁,可能执行完全错误的操作。Anthropic暴露的这个问题,是整个行业的阿喀琉斯之踵。
六、中国视角:三条技术主线的同步突破
在中国,AI产业的叙事也在发生重要转变。据头条搜索的热门分析,2026年6月初的产业节点上,人工智能行业正告别单纯追逐大模型参数竞赛的粗放阶段,转向专用推理芯片、操作系统级AI智能体、物理世界具身智能三条技术主线同步突破。
这三条线恰好对应了全球AI"桌面战争"的三个维度:
- 专用推理芯片——端侧AI的算力基础,对应华为"韬定律"和海光信息的国产平台适配;
- 操作系统级AI智能体——与微软"超级应用"和OpenAI Codex直接竞争,对应腾讯Agent Runtime的全面出海;
- 物理世界具身智能——AI从数字世界走向物理世界的下一步,Rokid AI眼镜日本众筹6.24亿日元创纪录就是信号。
中国的AI产业不是在跟随,而是在寻找不同的突围路径——从算力自主到Agent平台出海,从软件优化到硬件落地。这条路的终点可能与美国不同,但战争的节奏是同步的。
结论:桌面是新的高地
2026年5月的最后一周,AI产业发生了一件比任何融资和产品发布都重要的事:Agent的战场从云端降到了桌面。
这意味着AI竞争的规则变了。在云端,竞争的核心是"谁更聪明"——模型参数、训练数据、推理速度。在桌面,竞争的核心变成了"谁更可信"——安全记录、用户体验、生态整合。
OpenAI用Codex证明了自己的野心不限于API;微软用"超级应用"宣示了操作系统的主权;Anthropic用9000亿估值说明安全叙事也可以是最强的商业叙事。
但真正的赢家不是拥有最强模型的人,而是让用户愿意把电脑控制权交出来的人。这需要的不只是能力,而是信任。
信任——这个AI行业最稀缺、最难量化、也最有价值的东西,正在成为"桌面战争"的终极武器。
谁能赢得这场战争?现在下结论还太早。但有一点是确定的:当AI住进你的桌面,一切都将不同。