OpenAI推出Ultrafast模式:GPT-5.6 Sol速度飙升14倍

OpenAI推出Ultrafast模式,GPT-5.6 Sol速度提升14倍,每秒生成750 token,由Cerebras芯片提供算力支持,优先向API企业客户开放。

OpenAI本周给开发者带来了一个大惊喜——Ultrafast模式正式上线预览。这个新模式让GPT-5.6 Sol的推理速度最高提升了14倍,每秒可生成750个token,堪称目前最快的前沿AI模型。

核心看点

1. 速度飞跃:14倍提升

Ultrafast模式由Cerebras芯片提供算力支持,将GPT-5.6 Sol的生成速度推到了每秒750 token。这意味着什么?以前需要等几秒才能得到的回答,现在眨眼间就能完成。对于需要实时交互的场景,比如客服机器人、实时翻译、代码补全,这个提升是革命性的。

2. 先API后产品

OpenAI这次采取了先API后面向消费者的策略。目前Ultrafast模式优先向API企业客户开放,特别是那些对速度敏感的业务场景,比如金融交易分析、实时数据处理、高频交互应用等。随着算力扩容,会逐渐向更多企业开放。

3. 速度与智能兼得

通常速度提升意味着牺牲质量,但Ultrafast模式依然保持了GPT-5.6 Sol的推理能力。OpenAI表示正在与首批客户合作,了解在哪些场景下这种极速推理能创造最大价值,这些经验将指导未来的产品方向。

详细解析

这次更新有几个值得关注的点:

技术层面:与Cerebras的合作值得关注。Cerebras以其巨型晶圆级处理器(Wafer Scale Engine)闻名,这种专门为AI推理优化的硬件可能是实现14倍加速的关键。这也暗示OpenAI正在探索多元化的算力方案,不仅仅依赖NVIDIA的GPU。

商业层面:Ultrafast模式显然是冲着企业级市场去的。OpenAI在推文中明确提到为每秒钟都重要的业务场景设计,这包括金融、医疗、自动驾驶等对延迟极度敏感的行业。定价策略目前尚未公布,但预计会比标准API更贵。

竞争格局:随着Claude、Gemini等对手不断追赶,速度成了OpenAI的新护城河。14倍的速度优势,加上GPT-5.6 Sol本身强大的推理能力,让OpenAI在实时AI应用市场占据了有利位置。

总结

Ultrafast模式的推出标志着AI推理进入了一个新阶段——不只是聪明,还要够快。对于开发者来说,这意味着可以构建更流畅的AI应用;对于终端用户来说,AI的响应将快到几乎感受不到延迟。

不过目前仅限部分API客户使用,普通用户还得再等等。如果你的业务对AI响应速度有极致要求,可以去OpenAI官网申请加入等待列表。

本文地址:https://www.163264.com/14939

(0)
上一篇 19小时前
下一篇 18小时前

相关推荐