鱼与熊掌的折中方案
OpenAI宣布Ultrafast模式面向GPT-6.1 Sol正式推送,覆盖API、Codex与ChatGPT Work三大场景。官方称该模式在保持接近旗舰Astra级别智能水平的同时,速度最高达到Sol标准模式的8倍,直接回应开发者对「智能与延迟不可兼得」的长期抱怨。
速度成为产品竞争力
在模型能力差距收窄的背景下,推理速度与成本正成为模型厂商争夺开发者的主战场。Ultrafast模式瞄准的是高频调用场景:代码补全、智能体循环、实时客服等对首token延迟敏感的工作负载。
同场竞速
同期Anthropic以Haiku 5.5主打速度与75%成本降幅,谷歌Gemini以缓存输入95%折扣拉低门槛,各家不约而同把「快与便宜」做成显性卖点。对用户而言,旗舰智能与小模型速度正在同一产品线内自由切换,模型选择权持续向自动路由演化。
