世界末日倒计时|2026-06-28
过去 24 小时里,值得关注的 AI 前沿消息不算多,但都指向同一件事:行业竞争已经不只是“谁的模型更强”,而是“谁能把智能体真正放进工作流、谁能把低时延推理跑起来、谁能把评测做得更像真实世界”。
-
OpenAI 给出了智能体进入真实工作流的量化证据。 OpenAI 在官方文章《How agents are transforming work》中披露,到 2026 年 6 月,公司内部最重度的一批用户每天会并行运行超过 60 小时的 Codex agent turn;对平均 OpenAI 员工而言,Codex 已占到其 AI 输出 token 的 85% 以上,而公司整体周度输出 token 中 Codex 占比达到 99.8%。更关键的是,法律、财务、招聘等非工程团队也已把 Codex 作为主要 AI 工具。这类带口径的数据很少见,它说明“agent 进入生产流”已经不再只是演示。来源:OpenAI 官方。
-
OpenAI 与 Cerebras 同步强调低延迟推理合作,基础设施分层继续深化。 过去一天内,OpenAI 官方页面与 Cerebras 官方博客都在强调双方的合作:Cerebras 的低延迟推理能力将分阶段接入 OpenAI 的 inference stack,相关容量计划在 2028 年前逐步上线。Cerebras 披露的是多年度合作与 wafer-scale systems 的部署计划;OpenAI 的表述则更聚焦于“为不同工作负载匹配不同系统”。这说明头部模型公司正在把推理层拆成更细的基础设施组合,而不是只依赖单一云或单一路线。来源:OpenAI 官方、Cerebras 官方。
-
Patronus AI 获 5000 万美元融资,资本开始押注“智能体评测环境”。 TechCrunch 6 月 25 日报道,AI 评测公司 Patronus AI 完成 5000 万美元 B 轮融资,总融资额达到 7000 万美元。报道提到,这家公司正构建用于软件工程和金融场景的“数字世界模型”,让智能体在模拟网站和内部系统中完成长链路任务,并用可验证结果去识别投机取巧和失败模式。值得注意的不是融资额本身,而是资金开始流向“如何验证智能体在复杂环境里是否可靠”这件更底层的能力。来源:TechCrunch。
如果只看这一天,信号已经很明确:前沿 AI 的主战场正在从单纯的模型参数竞赛,转向工作流渗透、推理基础设施分工,以及更严格的智能体验证。