返回列表
Cerebras联手OpenAI推出GPT-5.6 Sol超快模式:推理速度提升11倍,每秒输出750个Token
产品发布OpenAICerebrasGPT-5.6

Cerebras联手OpenAI推出GPT-5.6 Sol超快模式:推理速度提升11倍,每秒输出750个Token

Cerebras与OpenAI宣布在OpenAI API中推出由Cerebras硬件驱动的全新“超快模式”(Ultrafast Mode)。该模式下的GPT-5.6 Sol模型实现了每秒750个Token的惊人输出速度,且不牺牲模型质量。在针对博士级难度的HLE基准测试中,GPT-5.6 Sol仅需约11小时即可完成全部测试,速度比竞争对手快近7倍,彻底解决了前沿AI智能与响应速度之间的权衡难题。

Hacker News

核心要点

  • 全新服务层级:OpenAI与Cerebras合作推出“超快模式”(Ultrafast Mode),首发于OpenAI API,初期面向特定客户开放。
  • 极致推理速度:GPT-5.6 Sol在超快模式下可达到每秒750个Token的输出,且模型质量无任何妥协。
  • 显著性能优势:运行速度比Fable 5快11倍,比Opus 4.8的快速模式快5倍。
  • 基准测试突破:在Humanity's Last Exam (HLE) 测试中,该模型仅用11小时11分钟完成2500道高难度题目,而竞争对手需耗时超过3天。

详细分析

突破智能与速度的权衡瓶颈

长期以来,AI开发者和用户一直面临着在“速度”与“智能”之间进行二选一的困境。随着模型规模和智能程度的提升,计算量和数据传输成本也随之激增,导致响应时间变长。用户往往需要为了高质量结果而忍受漫长的等待,或者为了速度而接受较低质量的输出。GPT-5.6 Sol超快模式的出现解决了这一矛盾,它将前沿的智能水平引入到对时间敏感、任务关键型的产品和工作流中,确保在每一秒都至关重要的场景下依然能提供顶级性能。

卓越的基准测试表现

为了验证超快模式的实际效能,Cerebras将其应用于“Humanity's Last Exam (HLE)”基准测试。该测试包含2500个极具挑战性的问题,通常只有化学、经济学和文学等领域的博士学位持有者才能回答。评估结果显示,GPT-5.6 Sol在超快模式下仅用11小时11分钟就完成了全部题目。相比之下,Claude Fable 5需要长达78小时27分钟(超过三天的连续计算)才能得出相同的结论。这意味着超快模式能在单个工作日内处理完人类知识的前沿难题,且准确率保持一致,速度提升了近7倍。

行业影响

此次Cerebras与OpenAI的合作标志着AI基础设施与顶级大模型算法的深度融合。通过利用Cerebras专为AI设计的硬件加速能力,OpenAI能够提供远超传统云端推理速度的服务。这将极大地推动实时AI交互、大规模复杂逻辑推理以及对延迟极度敏感的企业级应用的发展,重新定义了前沿模型在生产环境中的性能标准。

常见问题

什么是GPT-5.6 Sol的“超快模式”?

这是OpenAI API中新增的一个服务层级,由Cerebras的硬件提供动力支持,专门用于加速GPT-5.6 Sol模型的推理过程,使其达到极高的Token输出频率。

超快模式在速度上有哪些具体数据?

该模式支持每秒高达750个Token的输出。根据报告,它的运行速度是Fable 5的11倍,是Opus 4.8快速模式的5倍。

谁可以开始使用这一新功能?

目前超快模式最初仅提供给一小部分选定的客户使用,OpenAI计划随着时间的推移逐步扩大访问权限。

相关新闻