8 月下旬,两条围绕 OpenAI 的动态把「Agent 执行层」推到了台前:一边是被曝将进一步开放 Codex 的底层能力,另一边是 GPT-5.6 Sol 的 Ultrafast 速度预览。它们指向同一件事——当模型既便宜又快,Agent 从「会写代码」走向「能稳定当生产力」,门槛正被快速抹平。
一、Codex 底层能力进一步开放
据行业媒体 8 月 22 日前后报道,OpenAI 正在进一步开放 Codex 的底层能力。对开发者而言,这意味着 Agent 编程与自动化开发不再被封在封闭接口里,而是可以被更自由地嵌入自有工作流。报道将其解读为:Codex 有望成为 Agent 工作流的「通用执行层」——上接业务意图,下接具体动作(写码、改码、跑测试、提交)。当执行层被普遍开放,模型厂商的护城河就从「能不能干」转向「干得顺不顺手、贵不贵、能不能编排」。
二、速度成了新战场
与 Cerebras 共建的 GPT-5.6 Sol Ultrafast 预览,把输出速度推到约 14 倍、最高约 750 输出 token/秒。更关键的是质量没有塌方:官方口径称,Sol 在「低推理」档位上,于 Agents' Last Exam 已能超过早先 GPT-5.5 的「高推理」档位。配合 Responses API 内建的原生多智能体编排、保留推理状态与程序化工具调用,OpenAI 把「快、便宜、可编排」三件事捆在了一起。
过去比的是「模型上限」,现在比的是「执行层下限」——能不能又便宜、又够快、又稳定地常驻运行。Agent 的竞争重心,正从参数与基准,滑向工程可用性的细节。
三、便宜 + 快,改变了什么
前沿级 Agent 跑在实时循环里,成本与延迟曾是最大的两道坎:贵,就只敢跑演示;慢,就接不住多步任务。当成本地板被大幅压低、速度又上一个台阶,常驻自主 Agent 就从「概念验证」变成可以写进预算表的生产力。对企业来说,这意味着一批原本「想做但不敢常开」的自动化流程,开始具备经济性。
四、对开发者的含义
- 执行层标准化:Codex 这类能力的开放,让「Agent 怎么落地跑起来」有了更通用的底座,少造轮子。
- 速度门槛下降:高吞吐场景(长程编码、批量文档处理)的体验会被重写,等待感不再是体验黑洞。
- 竞争迁移:模型之间的比拼,越来越像「谁的执行层更顺手」的比拼,而非单纯跑分。
五、仍要冷静看待
需要标注的是:Ultrafast 属「预览」性质,其峰值速度高度依赖特定硬件(Cerebras),在通用算力上的普遍可用性仍待验证;相关数字多为厂商自报,独立复现尚未充分。把预览速度直接等同生产体验,容易高估。对采购方而言,真正该盯的是「在自己真实负载下的稳定吞吐与单任务成本」,而非发布会上的峰值数字。
无论如何,把「执行层」与「速度」摆上明面竞争,说明 Agent 行业已经过了比谁更聪明的阶段,进入了比谁更好用的阶段。下一个分水岭,或许不是又一个更强的模型,而是一套让开发者敢天天调用的执行基础设施。