每秒750个token的Ultrafast API要扩大开放,OpenAI可能赶在DevDay前后放量

AI资讯12分钟前发布 esme
2.5K 0

一秒钟吐出750个token是什么概念?一段一千五百token左右的回答,两秒出完,眼睛还没对上焦,字已经铺满屏幕了。

这就是OpenAI手里那个Ultrafast模式的上限。它是跟着GPT-5.6 Sol一起露面的,一直是预览状态,只对受邀客户开放,普通开发者摸不到。现在的消息是,OpenAI准备在9月29日DevDay前后把开放范围扩大。

官方给的对比口径是推理速度比Standard档快14倍。

如果放开,开发者在Playground里大概会看到三个档位:Standard、Fast、Ultrafast。这个分档思路其实挺实在,它等于承认了一件事:同一个模型,不同场景对速度的敏感度差得很远。写一份周报,慢几秒没人在乎;可要是做实时语音对话、代码补全、或者让智能体连续调用十几轮工具,每一轮都卡一下,累积起来用户体验就崩了。过去大家的解法是换小模型,用能力换速度,现在OpenAI想给另一条路:模型不换,花钱买速度。

我觉得这事的关键不在750这个数字本身,而在”档位化”。一旦速度变成可以单独定价的维度,开发者做选型时就多了一根轴,以前比的是哪家模型聪明、哪家便宜,以后还得比同样聪明的前提下谁更快、快一档要多掏多少。对做Codex这类编程工具、或者在ChatGPT生态上做实时应用的团队来说,这个选项会直接影响产品形态。

当然,还有几件事没说清。价格没公布,三档之间差多少钱目前只能猜;GPT-6会不会支持Ultrafast,也还是个问号。

DevDay就在两天后,到时候答案应该会清楚一些。

© 版权声明

相关文章

每秒750个token的Ultrafast API要扩大开放,OpenAI可能赶在DevDay前后放量 暂无评论

none
暂无评论...