首页>资讯>矿业 > 正文

Cerebras芯片推动GPT-5.6 Sol在OpenAI预览中达到每秒750个token的吞吐量

2026-08-14 21:23 loading...

Gate.io

币安Binance

币安交易所是全球加密货币交易所龙头,在手机上即可买卖比特币等数字货币!

官网注册  APP下载

OpenAI 推出超快速 GPT-5.6 Sol 预览版

OpenAI 于周四开放了超快速 GPT-5.6 Sol 的有限预览。该模型在 API 服务层级运行,输出速度高达每秒 750 个 token。

ChatGPT 的制造商表示,该层级的处理速度比标准处理快 14 倍。公司目前正与少量 API 客户进行测试,以评估需求与容量。

Cerebras 芯片提供算力支撑

这一速度得益于 Cerebras(纳斯达克代码:CBRS)的芯片。这家芯片制造商于今年一月与 OpenAI 达成了一项计算交易。

Cerebras 周四表示,其芯片为 GPT-5.6 Sol 提供动力。该芯片尺寸为晶圆级,芯片内集成了 44 GB 的 SRAM。

今年一月,OpenAI 同意在三年内购买高达 750 兆瓦的 Cerebras 计算能力。预计容量将在 2028 年前分批交付。Sam Altman 被列为 Cerebras 的投资者之一。

速度对比:远超其他模型

Cerebras 表示,超快速模式在输出速度上比 Claude Opus 4.8 的快速模式快 5 倍,比 Claude Fable 5 快 11 倍。Anthropic 也推出了自己的加速版 Claude Fast 模式,但未能达到 OpenAI 所引用的数字。

Cerebras 宣布,其 GPT-5.6 Sol Ultrafast 在短短 11 小时多一点的时间内完成了“人类最终考试”(一份包含 2500 道研究生级别化学、经济学和文学问题的测试)。其准确率与 Claude Fable 5 相近,而后者需要连续计算超过三天才能完成。

Cerebras 声称,在 GDP-Val 基准测试上实现了 5.6 倍的端到端加速,且质量没有下降。该基准测试围绕付费知识工作(如法律简报和金融模型)构建。token 是语言模型在生成文本时产生的文本片段。

超快速模式专为不能等待的任务而设计

OpenAI 正在部署超快速模式,用于那些无法等待较慢模型的任务。

在其公告中,公司列举了事件响应、欺诈与市场分析、实时客户支持、电子商务以及交互式研究作为早期应用场景。

在系统中断期间,工程师使用该层级来读取日志、分析追踪信息,并在系统仍在故障时帮助验证修复方案,而部署决策仍由人类做出。

“GPT-5.6 Sol 超快速模式证明速度与智能不再互斥,”Cerebras 首席执行官 Andrew Feldman 在公司新闻稿中表示。

OpenAI 的计算策略与 GPT-Infra 副总裁 Sachin Katti 表示,公司“从一小部分客户开始,以了解这种速度在哪些地方能创造有意义的价值。”

此前报道:模型曾出现自主行为

今年七月,有报道称 GPT-5.6 Sol(该 AI 的编码版本)曾自主删除文件、编码工作树,以及至少一个生产数据库。

OthersideAI 首席执行官 Matt Shumer 在 X 上写道,Sol“意外删除了我 Mac 上几乎所有的文件”,而开发者 Bruno Lemos 则表示它清除了他的生产数据库。

在 Sol 发布前两周,OpenAI 自己的系统卡片已标记了这种行为。它警告该模型可能“过于自主”,并且对指令的解读过于宽松。

Gate.io

欧易OKX

全球专业交易所,来欧易注册免费赢取新用户奖励!

官网注册  APP下载
声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
相关阅读相关阅读
热门资讯热门资讯
风险
提示

币圈网数据及信息均来源公开资料,不构成任何推荐或投资建议。炒币属投资行为,市场有风险,投资需谨慎。

粤ICP备2024291203号 Copyrigh© 币圈网 Alibtc.com