预览Ultrafast模式:GPT-5.6 Sol速度提升高达14倍
今天,我们带来一项新服务层级 Ultrafast 的早期预览,它运行 GPT‑5.6 Sol 的速度最快可达 Standard 处理的 14 倍,并率先在 OpenAI API 中推出。Ultrafast 由 Cerebras 提供支持,每秒最多可生成 750 个输出 Token,将我们最智能的模型带到每一秒都至关重要的产品和工作中。
借助 GPT‑5.6,我们正在拓展模型能力的边界,并在技术栈的每一层提升效率。这些改进让先进智能更加实惠,也为更多人带来更大价值。在此之前,获得实时速度通常意味着要选择更小或更专门的模型。Ultrafast 则指向了一个新方向的进展:每秒完成更多有效工作。
当速度不再需要以牺牲智能为代价时,AI 就能进入业务中最具时效性的环节,新的工作形态也随之成为可能。我们已经看到了一些令人鼓舞的 Ultrafast 应用场景:
- 事件响应与可靠性: 当关键系统发生故障时,在故障仍在持续期间,分析应用日志、最近的代码变更和工程师报告,找出可能的原因并帮助准备修复方案。
- 金融研究与安全: 在市场条件仍在变化时,分析市场信号、评估交易并识别可疑活动。
- 客户支持与语音: 在不打断对话的情况下实时解决复杂的客户问题,即使找到答案需要多个步骤或系统。
- 电商: 在购物者仍在做决定时,回答产品问题、检查库存、提供个性化推荐并解决结账问题,在犹豫演变为弃单之前。
- 实时研究与实验: 将以往需要通宵运行的研究转变为交互式工作会话,让团队可以测试想法、检查结果、调整方法,再运行下一个实验,而不会打断工作节奏。
在预览期间,我们正在与首批客户合作,了解这种速度在哪些方面能产生最大的影响,以及这些经验如何长期指导我们的产品发展。
GPT‑5.6 Sol Ultrafast 与 Standard 根据同一文本提示,并排构建一个可用的 3D 仓库模拟器。
早期客户的体验
我们一直在与首批来自编码、电商、金融研究、支持及其他交互应用领域的公司一同测试 Ultrafast 模式下的 GPT‑5.6 Sol。从业务流程入手,让我们能够在真实的生产环境中研究这些场景。他们的早期工作帮助我们了解,速度上一个数量级的变化在哪些地方能创造最大价值,以及当模型能够跟上使用者节奏时,产品会发生怎样的变化。随着容量增长,我们将利用这些发现来指导部署。
“Cerebras 带来的速度提升令人印象深刻。它开启了使用模型的不同方式,让开发者能够以更专注、更高效的方式与之协作。”
—John Crepezzi,AI Assistants,Jane Street
“对我们来说,Ultrafast 在我们的语音技术栈中价值巨大。这种速度彻底改变了更复杂工作中的通话体验。”
—Courtland Lykins,语音 AI 产品负责人,Podium
“Ultrafast 让我们能够为用户创造以往受限于智能水平的同步体验。通常,实现真正快速产品的障碍不仅仅是每秒 Token 数,还包括模型智能,而 Ultrafast 两者兼得。”
—Mitch Troyanovsky,联合创始人,Basis
“速度不只是让产品感觉更好。它改变了人们实际能用它来做的事。Ultrafast 让复杂的金融研究感觉像一次实时互动。”
—Alex Wang,Applied AI,Rogo
OpenAI 如何使用 Ultrafast
在 OpenAI 内部,一组开发者一直在 Ultrafast 模式下测试 GPT‑5.6 Sol,以了解哪些工作流程能受益于可实时回应的前沿智能。
事件响应就是我们团队使用 Ultrafast 的一个例子。当警报触发时,工程师需要在系统和证据仍在不断变化的情况下,建立起准确的全貌。团队用它来快速读取日志、分析追踪、综合对话、确定下一步检查项,并帮助准备或验证修复方案——所有这些都只需原本所需时间的一小部分,并以 Sol 的智能水平完成。它缩短了观察信号、验证假设与选择下一步行动之间的延迟,而工程师仍然负责判断和部署。
在研究方面,我们的团队使用 Ultrafast 快速检索知识来源、查询数据,并在关联工具之间快速收集、整理和汇总信息。研究中的一个常见流程是,团队成员在夜间启动一批实验,第二天早上查看结果。借助 Ultrafast,我们看到这一循环正在缩短,可以在工作日内支持多轮迭代。
由 Cerebras 提供支持
Ultrafast 标志着我们与 Cerebras 合作关系迈出的下一步,旨在为 OpenAI 平台带来超低延迟推理。现在,通过 Ultrafast 模式下的 GPT‑5.6 Sol,Cerebras 为 OpenAI 最智能的模型提供支持,每秒最多交付 750 个输出 Token,使企业能够构建响应更迅速的产品、做出更快的决策,并将强大的 AI 直接带入其要求最严苛的工作流程。
可用性
Ultrafast 模式下的 GPT‑5.6 Sol 今天以有限预览的形式向选定的客户群提供。随着容量增长,我们将扩大开放范围。
- 原文链接: openai.com/index/preview...
- 鸿途知科网 AI 助手,为大家转译优秀英文文章,如有翻译不通的地方,还请包涵~
版权声明
本文仅代表作者观点,不代表区块链技术网立场。
本文系作者授权本站发表,未经许可,不得转载。
鸿途知科网
发表评论:
◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。