首页>资讯>矿业 > 正文

OpenAI发布GPT-6 Sol与Luna,对标Anthropic强化性价比竞争

2026-09-23 04:41 loading...

Gate.io

币安Binance

币安交易所是全球加密货币交易所龙头,在手机上即可买卖比特币等数字货币!

官网注册  APP下载

OpenAI发布GPT-6 Sol与Luna,直面Anthropic竞争

周二,OpenAI正式上线两款新模型——GPT-6 Sol与GPT-6 Luna,紧随Anthropic发布Claude Opus 5.5之后,标志着大模型市场竞争进入新阶段。

产品定位与层级策略

GPT-6 Sol与Luna定位于低于旗舰模型GPT-6 Astra的轻量级解决方案。Astra被OpenAI定义为“当前最智能且对齐度最高”的模型,主要用于复杂任务处理;而Sol与Luna则专为高频、低成本的日常工作流设计,满足企业级应用对效率与经济性的双重需求。

该架构与Anthropic的产品路线高度一致:Astra对应Fable,Sol对应Opus,Terra对应Sonnet,Luna则相当于升级后的Haiku,形成清晰的分层体系。

价格下调释放显著性价比优势

为增强市场渗透力,OpenAI将两款模型的API计费标准全面下调。相较GPT-5.6促销费率,输入与输出令牌单价均削减50%。其中,‘令牌’是模型处理文本的基本单位,通常接近一个单词,企业按百万级别结算,直接影响大规模部署成本。

具体定价如下:

GPT-6 Sol:输入每百万令牌2美元,输出10美元(原价分别为4美元和20美元)。

GPT-6 Luna:输入每百万0.10美元,输出0.50美元(原价分别为0.20美元和1.20美元)。

整体来看,无论在性能还是价格维度,OpenAI的新方案均展现出更强的综合竞争力。

多维基准测试验证性能突破

在Zapier构建的AutomationBench测试中,评估AI代理跨销售、营销、财务、人力等47个工具完成端到端工作流的能力,以通过率作为核心指标:

GPT-6 Sol在最高推理设置下取得33.2%通过率,每项任务成本0.27美元。相比之下,Claude Opus 5在同等条件下通过率为26.9%,但任务成本高出超过11倍。值得注意的是,GPT-6 Sol还略微领先于更昂贵的Claude Fable 5.1。

在另一项长期任务评估“Agents' Last Exam”中,测试涵盖55个子行业的高阶经济价值工作,以完成百分比为评分依据:

GPT-6 Sol在最高努力模式下达成56.4%完成率,优于Claude Opus 5最佳表现,且每任务成本低60%。

推理能力与真实场景表现

OpenAI引入“推理努力”调节机制,允许用户根据准确率需求提升模型计算资源投入。提高该设置可增强答案自检能力,从而提升结果可靠性,但相应增加运行开销。

在模拟真实计算机操作的OSWorld 2.0测试中,评估模型执行点击、输入、导航等行为的准确性:

GPT-6 Sol得分60.5%,与Claude Opus 5中等努力模式(60.3%)几乎持平,但成本降低约80%。该测试关注长期任务的连续性与正确性,部分完成亦可获得分数。

上线范围与逐步开放计划

GPT-6 Sol与Luna目前已在ChatGPT Work及Plus、Pro、Business、Enterprise和Edu订阅用户所使用的Codex系统中上线。Luna也已向免费用户和Go用户开放桌面端访问。

目前尚未在普通版ChatGPT应用中提供。OpenAI表示,为保障系统稳定性,将采取分阶段推送策略,确保用户体验不受影响。

Gate.io

欧易OKX

全球专业交易所,来欧易注册免费赢取新用户奖励!

官网注册  APP下载
声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
相关阅读相关阅读
热门资讯热门资讯
风险
提示

币圈网数据及信息均来源公开资料,不构成任何推荐或投资建议。炒币属投资行为,市场有风险,投资需谨慎。

粤ICP备2024291203号 Copyrigh© 币圈网 Alibtc.com