OpenAI的API多了一个新档位。GPT-6.1 Sol的Ultrafast模式在Responses API上线,定位是这个接口里最快的服务层级,相对Standard最高约8倍的生成速度。所有API用户都能用,不需要申请。
代价写得很清楚:价格是Standard的6倍。短上下文下,每百万token输入约12美元、缓存输入0.60美元、输出60美元。
这个定价结构有两个地方值得算一算。
缓存输入只有0.60美元,是普通输入的二十分之一。意味着如果你的请求里大部分是重复的系统提示和长文档,Ultrafast的实际成本可能远没有“6倍”那么吓人。真正贵的是输出,60美元一百万token,长回复场景下会非常明显。
“短上下文”这个限定词也要留意。按OpenAI一贯的做法,超过某个长度阈值之后会有另一套价格,目前公布的只是短上下文档位。
这个模式的消息来自OpenAI开发者关系负责人Tibo正在做的“连续28天更新”系列的第四天。前几天放出的都是小改动,Ultrafast算是目前最实在的一个。
适合谁?实时语音、交互式编程助手、需要秒级响应的客服场景。这些地方延迟直接决定体验,愿意为速度付溢价的用户一直都有。批处理和离线任务就没必要碰它,Standard档的6倍价差在大批量下会很快变成真金白银。
Anthropic和谷歌目前都没有对应的“极速档”产品。OpenAI先把这个价格锚定在这里,后面同行怎么跟,是个看点。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






GPT-6.1 Sol上线Ultrafast档:最快8倍速度,价格是标准档6倍