同日“上新”的大模型:OpenAI与Anthropic竞逐“性价比”时代 - 搜狐网
Кратко: 同日“上新”的大模型:OpenAI与Anthropic竞逐“性价比”时代
——从能力比拼到落地效率,AI商业化进入新赛段
北京时间9月23日,全球人工智能领域的两个头部玩家OpenAI与Anthropic不约而同地选择了在联合国大会期间发布其新一代大模型。OpenAI推出了GPT-6系列的新成员Sol和Luna,而Anthropic则带来了Claude Opus 5.5。这两场发布的核心关键词惊人地一致: 性能提升、成本大幅下降。这一动作被业界解读为大模型竞赛的里程碑式转折——由单纯追求“能力天花板”的军备竞赛,转向了更为务实的“性价比落地”阶段。
一场不约而同的“降价升配”
综合多方信息来看,此次发布的核心看点并非某项单一能力的绝对领先,而是“效率”的系统性跃升。
OpenAI方面,全新的GPT-6 Sol和Luna模型,其API价格较之前的促销价降低了50%。虽然官方明确强调Astra版本仍是“整体最优秀的模型”,但Sol和Luna显然承担着规模化商用落地的重任。数据更具说服力:在AutomationBench的跨应用业务流程测试中,GPT-6 Sol在xhigh强度下的成本仅为Claude Opus 5每任务成本的9%;而在Last Exam测试中,Sol在max effort状态下得分高于Claude Opus 5的最高分,每任务成本却降低了60%。此外,OpenAI还对提示缓存进行了优化,默认提供更高的命中率,帮助开发者降低重复上下文的使用费用。
🧭 Извлечение: ok
· confidence 90%
· диагностика
High confidence: full text extraction produced 638 characters.
High confidence: full text extraction produced 638 characters.
同日“上新”的大模型:OpenAI与Anthropic竞逐“性价比”时代
——从能力比拼到落地效率,AI商业化进入新赛段
北京时间9月23日,全球人工智能领域的两个头部玩家OpenAI与Anthropic不约而同地选择了在联合国大会期间发布其新一代大模型。OpenAI推出了GPT-6系列的新成员Sol和Luna,而Anthropic则带来了Claude Opus 5.5。这两场发布的核心关键词惊人地一致: 性能提升、成本大幅下降。这一动作被业界解读为大模型竞赛的里程碑式转折——由单纯追求“能力天花板”的军备竞赛,转向了更为务实的“性价比落地”阶段。
一场不约而同的“降价升配”
综合多方信息来看,此次发布的核心看点并非某项单一能力的绝对领先,而是“效率”的系统性跃升。
OpenAI方面,全新的GPT-6 Sol和Luna模型,其API价格较之前的促销价降低了50%。虽然官方明确强调Astra版本仍是“整体最优秀的模型”,但Sol和Luna显然承担着规模化商用落地的重任。数据更具说服力:在AutomationBench的跨应用业务流程测试中,GPT-6 Sol在xhigh强度下的成本仅为Claude Opus 5每任务成本的9%;而在Last Exam测试中,Sol在max effort状态下得分高于Claude Opus 5的最高分,每任务成本却降低了60%。此外,OpenAI还对提示缓存进行了优化,默认提供更高的命中率,帮助开发者降低重复上下文的使用费用。