世界末日倒计时|2026-06-27
过去 24 小时里,值得记下来的 AI 前沿消息主要集中在两件事:一是“智能体”开始被更严肃地当作生产工具衡量,二是支撑实时推理的底层基础设施还在继续前移。
-
OpenAI 发布内部采用数据,说明智能体已从聊天工具转向主工作流。 6 月 25 日,OpenAI 在官方文章《How agents are transforming work》中披露,到 2026 年 6 月,OpenAI 内部活跃用户中最重度的一批人每天会并行运行超过 60 小时的 Codex agent turn;对平均 OpenAI 员工而言,Codex 已占到 85% 以上的输出 token,而公司整体周度输出 token 中 Codex 占比达到 99.8%。更值得注意的是,法律、财务、招聘等非工程团队也已把 Codex 变成主要 AI 工具。这个信号的价值在于,它给“agent 是否真的进入工作流”提供了少见的、带量化口径的官方样本。来源:OpenAI 官方。
-
OpenAI 与 Cerebras 公布低延迟推理合作的更多明确信息。 OpenAI 官方页面与 Cerebras 官方博客在过去一天内同时强调,双方将分阶段把 Cerebras 的低延迟推理能力接入 OpenAI 的 inference stack,相关容量会在 2028 年前分批上线。Cerebras 方面披露的口径是多年度合作、计划部署 750 兆瓦 wafer-scale systems;OpenAI 的表述则更克制,重点放在“为不同工作负载匹配不同系统”,把 Cerebras 作为实时、低时延推理的一块专用能力。这里真正值得关注的不是单一合作消息,而是头部模型公司继续把推理层拆分成更细的基础设施组合,而不是只押注单一云或单一 GPU 路线。来源:OpenAI 官方、Cerebras 官方。
-
Patronus AI 融资 5000 万美元,押注智能体的“可验证评测环境”。 6 月 25 日,TechCrunch 报道,做 AI 评测的 Patronus AI 完成 5000 万美元 B 轮融资,总融资额达到 7000 万美元。报道提到,这家公司正在构建用于软件工程和金融场景的“数字世界模型”,让智能体在模拟网站和内部系统里完成长链路任务,并通过强化学习和可验证结果来发现投机取巧或失败模式。对前沿 AI 来说,这类公司被资本追捧说明行业关注点正在从“模型会不会”转向“模型在复杂环境里能不能稳定做对”。来源:TechCrunch。
如果只看这一天,趋势已经很明显:AI 前沿竞争正在从更强模型,进一步转向更长时任务、更低时延推理,以及更严格的智能体验证体系。