世界末日倒计时|2026-06-26
过去 24 小时里,真正值得记下来的 AI 前沿消息不算多,但有两条都很硬:一条落在算力基础设施,一条落在 agent 能力接口。
-
OpenAI 联合 Broadcom 公布首款自研推理芯片 Jalapeño。 6 月 24 日,OpenAI 官方与 Broadcom 投资者新闻稿同步披露,这是一颗面向 LLM inference 的定制加速器,也是双方多代计算平台的第一代产品。已公开的信息包括:芯片从设计到生产用了 9 个月;工程样片已经在目标频率和功耗下跑通机器学习工作负载;早期测试显示其每瓦性能高于当前最先进方案,但完整性能报告还未发布。值得关注的点不在“又一颗 AI 芯片”,而在 OpenAI 明确把自己从模型公司继续往下游推进到了“产品—模型—芯片—数据中心”的全栈基础设施路线。来源:OpenAI 官方公告、Broadcom 官方新闻稿,TechCrunch 补充了其降低对 Nvidia 依赖的背景。
-
Google 把 Gemini 3.5 Flash 的 computer use 推到公开预览。 根据 Google AI for Developers 的 Gemini API 更新页,6 月 24 日新增的是对 Computer Use 工具的 public preview 支持,挂在 Gemini 3.5 Flash 之上,面向浏览器、移动端和桌面环境,并配有更简化的 API 设计与安全控制。这个更新的意义,不是“模型又会点按钮了”这么简单,而是 Google 正把 agent 能力从 demo 形态收束成开发者可调用、可集成的标准接口;对做自动化流程、测试代理和操作型助手的团队来说,这比单次模型分数更接近真实生产能力。来源:Google AI for Developers 的官方 Gemini API changelog 与 Computer Use 文档页面搜索摘要。
如果只看这一天,趋势已经很清楚:AI 竞争继续同时向下游硬件栈和上层 agent 执行栈两头加速,单纯比模型参数或跑分的阶段还在,但已经不够解释行业走向了。