加速GPT-5.6 Sol超快速
今天,Cerebras和OpenAI共同分享了超快速模式的早期预览,这是一项首先在OpenAI API中推出的新服务级别,由Cerebras提供支持。超快速最初向一小部分客户开放,逐步扩大访问权限。Cerebras在超快速模式下为GPT-5.6 Sol提供动力,每秒可提供多达750个输出标记且不会影响质量,使Sol超快速能够加速您最时间敏感的关键任务。前沿智能以史无前例的速度 AI构建者一直需要在速度和智能之间进行选择。随着模型规模和智能的提升,它们会产生更高的计算和数据移动成本,从而减慢响应时间。用户通常需要等待高质量的结果,或者在较短的时间内接受劣质的结果。GPT-5.6 Sol超快速解决了这一取舍,将前沿智能带入每一秒都至关重要的产品和工作流程。与人工分析报告的输出速度相比,GPT-5.6 Sol在超快速模式下运行速度比Fable 5快11倍,比Opus 4.8在快速模式下快5倍。在Cerebras,我们通过与流行模型在“人类最后的考试”中逐一测试超快速模式。HLE是一个具有挑战性的模型基准,包含2500个问题,仅由化学、经济学和文学等领域拥有博士学位的人才能回答。在我们的评估中,GPT-5.6 Sol在超快速模式下只用11小时11分钟就回答了所有2500个HLE问题,而Claude Fable 5则需要78小时27分钟,超过三天的持续计算才能得出相同结论。换句话说,超快速在一个工作日内解决了人类知识的前沿问题,以将近7倍的速度实现了相当的准确性。基准测试由Cerebras使用GPT 5.6 Sol超快速与Codex在高推理下在7月10日进行,而Claude Fable 5则使用Claude Code在高推理下于7月13日至15日进行。随着模型能力的不断提升,快速推理的应用范围扩大。GPT-5.6 Sol是OpenAI迄今为止在法律简报、财务模型和工程报告方面表现最佳的模型。在针对经济价值知识工作任务的基准GDP-Val上,超快速提供了5.6倍的端到端加速,没有质量下降,显示出更快的推理如何加快经济价值工作的进程。基准测试由Cerebras于2026年7月31日使用GPT 5.6 Sol和GPT 5.6 Sol超快速在Codex中进行的中等推理。高速智能推动高风险工作 更快的智能改变了个人和组织的可能性。借助超快速,您现在可以将智能体放在问题的关键路径上,而每一秒都至关重要。"通过GPT-5.6 Sol超快速,Cerebras使人工智能能够跟上您的思维、编码和协作方式。我们期待看到超快速推理如何改变工作流程和应用程序。" Rohan Varma OpenAI产品 超快速为使用前沿人工智能的组织提供了持续的优势,以快速响应即将到来的信息。运营网络服务的公司可以利用超快速来根本原因分析并处理生产故障,维护客户信任,防止收入损失,并节省与其服务级别协议(SLA)相关的停机时间。而在对抗性高风险的网络攻击中,超快速是安全团队的宝贵工具,他们必须迅速检测并对不法行为做出反应,以控制灾难性损失。更广泛地说,超快速使与智能体工作的新模式成为可能,它提供实时的见解和更新,因此您不必在多个并行会话之间切换,以充分利用您的智能体。"我以前可能需要等几分钟才能完成一个任务,现在它在我甚至有机会切换上下文之前就完成了。这让我变得更加高效。" Jeffrey Wang OpenAI研究员 有了超快速,研究人员和工程师可以将精力集中在最重要的特定问题上,同时继续使用标准处理来并行化常规任务。Cerebras对推动下一波人工智能创新感到兴奋,提高了个人和组织能够以响应性人工智能完成的工作的上限。突破性创新推动了飞速发展 在超快速模式下的GPT-5.6 Sol由Cerebras革命性的晶圆级引擎架构提供动力,专门为前沿AI工作负载构建。快速前沿推理是一个数据移动问题:在GPU上,推理大模型受到内存带宽的瓶颈,因为模型权重必须在芯片内存和外部存储之间反复传输,以生成模型响应中的连续标记。Cerebras采取了一种反向的方式来消除这种低效的数据移动:我们在每个晶圆大小的芯片上集成44GB的SRAM。权重保持在芯片上,标记在跨晶圆的模型层之间无缝流动。这个技术方法平滑地随 m 扩展。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡