OpenAI发布GPT-6 Sol与Luna,对标Anthropic强化性价比竞争
2026-09-23 04:41 loading...
OpenAI发布GPT-6 Sol与Luna,直面Anthropic竞争
周二,OpenAI正式上线两款新模型——GPT-6 Sol与GPT-6 Luna,紧随Anthropic发布Claude Opus 5.5之后,标志着大模型市场竞争进入新阶段。
产品定位与层级策略
GPT-6 Sol与Luna定位于低于旗舰模型GPT-6 Astra的轻量级解决方案。Astra被OpenAI定义为“当前最智能且对齐度最高”的模型,主要用于复杂任务处理;而Sol与Luna则专为高频、低成本的日常工作流设计,满足企业级应用对效率与经济性的双重需求。
该架构与Anthropic的产品路线高度一致:Astra对应Fable,Sol对应Opus,Terra对应Sonnet,Luna则相当于升级后的Haiku,形成清晰的分层体系。
价格下调释放显著性价比优势
为增强市场渗透力,OpenAI将两款模型的API计费标准全面下调。相较GPT-5.6促销费率,输入与输出令牌单价均削减50%。其中,‘令牌’是模型处理文本的基本单位,通常接近一个单词,企业按百万级别结算,直接影响大规模部署成本。
具体定价如下:
GPT-6 Sol:输入每百万令牌2美元,输出10美元(原价分别为4美元和20美元)。
GPT-6 Luna:输入每百万0.10美元,输出0.50美元(原价分别为0.20美元和1.20美元)。
整体来看,无论在性能还是价格维度,OpenAI的新方案均展现出更强的综合竞争力。
多维基准测试验证性能突破
在Zapier构建的AutomationBench测试中,评估AI代理跨销售、营销、财务、人力等47个工具完成端到端工作流的能力,以通过率作为核心指标:
GPT-6 Sol在最高推理设置下取得33.2%通过率,每项任务成本0.27美元。相比之下,Claude Opus 5在同等条件下通过率为26.9%,但任务成本高出超过11倍。值得注意的是,GPT-6 Sol还略微领先于更昂贵的Claude Fable 5.1。
在另一项长期任务评估“Agents' Last Exam”中,测试涵盖55个子行业的高阶经济价值工作,以完成百分比为评分依据:
GPT-6 Sol在最高努力模式下达成56.4%完成率,优于Claude Opus 5最佳表现,且每任务成本低60%。
推理能力与真实场景表现
OpenAI引入“推理努力”调节机制,允许用户根据准确率需求提升模型计算资源投入。提高该设置可增强答案自检能力,从而提升结果可靠性,但相应增加运行开销。
在模拟真实计算机操作的OSWorld 2.0测试中,评估模型执行点击、输入、导航等行为的准确性:
GPT-6 Sol得分60.5%,与Claude Opus 5中等努力模式(60.3%)几乎持平,但成本降低约80%。该测试关注长期任务的连续性与正确性,部分完成亦可获得分数。
上线范围与逐步开放计划
GPT-6 Sol与Luna目前已在ChatGPT Work及Plus、Pro、Business、Enterprise和Edu订阅用户所使用的Codex系统中上线。Luna也已向免费用户和Go用户开放桌面端访问。
目前尚未在普通版ChatGPT应用中提供。OpenAI表示,为保障系统稳定性,将采取分阶段推送策略,确保用户体验不受影响。
相关阅读
-
比特币矿机公司 Riot 第三季度净利润达 1.045 亿美元,扭转了上一季度的亏损局面。比特币 2025-10-31 05:43
-
Arkham数据:德国政府再转出400BTC至Coinbase与Kraken比特币 2024-08-20 01:48
-
比特币积累激增,清算压力难挡矿业头条 2026-06-23 04:13
-
ERO币/Eroscoin是什么?ERO币上线交易所名单数字货币钱包 2024-08-19 22:16
-
uma币是什么币_uma币详细介绍WEB3.0 2025-01-10 01:24
-
pi币最近信息_pai币最初发行价格WEB3.0 2026-02-05 09:25
-
比特币回调至90,300美元支撑区,币安APP下载入口助力交易决策比特币 2026-01-08 22:32
-
高风险、高回报:识别 2025 年最有前景的加密货币预售和山寨币区块链 2025-12-06 07:24
-
Circle在OKX X Layer上推出原生USDC,支持跨链交互区块链 2026-08-08 02:22
-
比特币的宏观经济脆弱性:应对2025年经济衰退的战略调整比特币 2025-10-21 14:18