Tibo:今天750 token/s的Ultra Fast,一两年后可能成为标配

BiRun 讯,OpenAI 现在有一个付费高速档 Ultra Fast,只要氪金,模型就能回答得更快。开启后 GPT-5.6 Sol 最高能跑到每秒 750 个 Token,约为普通模式的 14 倍。Codex 负责人 Tibo Sottiaux 预计,再过 1 到 2 年,今天这种速度可能已经接近默认水平。

不过 14 倍只是模型本身的最高输出速度。真正拿来写代码,如果主要时间都在生成代码,整体能快约 10 倍;如果 Agent 还要搜索网页、跑工具、等网络返回,整个任务通常只快 3 到 4 倍。模型吐字越来越快后,瓶颈会从模型转到网络、CPU 和工具调用。

Ultra Fast 在 OpenAI 内部也得省着用。重大故障、关键原型等任务可以优先使用,但大部分算力还是留给外部客户,否则 OpenAI 自己的员工就能把容量吃光。

Matthew Berman
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯