Anthropic与OpenAI夜间发布新模型:Opus 5.5与GPT-6Sol性能对比分析

北京时间2025年9月23日,人工智能领域迎来了激动人心的时刻,Anthropic和OpenAI在同一夜间相继发布了新一代模型。Anthropic推出了Claude Opus 5.5,而OpenAI则发布了GPT-6Sol和GPT-6Luna。这次发布引发了广泛关注,不少Codex用户在社交媒体上翘首以盼。

OpenAI的GPT-6系列包括两个新版本,分别针对复杂编码工作流和高频任务进行了优化。GPT-6Sol的API输入和输出价格显著降低,分别为每百万token 2美元和10美元,较前代产品价格下降了近一半。GPT-6Luna则将输入价格压至0.1美元,输出价格降至0.5美元。这一系列降价策略使得新模型更具竞争力,尤其是在高频生产环境中。

在AutomationBench 1.0.6的测试中,GPT-6Sol以33.2%的任务完成率表现突出,成本相对较低。而Claude Opus 5在相同条件下的完成率为26.9%,成本则高出11.1倍。即便是与GPT-6Astra相比,Sol在低推理强度下的表现也更为优越。

与此同时,Anthropic的Opus 5.5被定位为性能更强的模型,声称在大多数任务中达到了Fable 5.1的水平,同时在速度和成本上均有所提升。Opus 5.5的上下文窗口为100万token,最大输出为12.8万token,输入和输出价格也相应降低,整体成本下降约40%。在长时间运行的编码智能体和知识工作方面,Opus 5.5的表现尤为突出。

在Terminal-Bench 4.0测试中,Opus 5.5以66.4%的得分超越了GPT-6Astra的57.9%。用户在使用Opus 5.5时,能够更高效地处理复杂的代码迁移任务,典型工作负载的整体成本显著降低。

值得一提的是,Opus 5.5是Anthropic在CEODario Amodei呼吁“放慢前沿”后的首款模型,经过严格的外部评估,表现出色。这标志着Anthropic在安全性和能力提升之间的平衡取得了进展。

总的来说,Opus 5.5与GPT-6Sol之间的竞争愈发激烈。虽然Opus 5.5在性能上略胜一筹,但GPT-6Sol凭借其更低的成本和针对高频任务的优化,也展现了强大的市场潜力。未来,随着这两家公司的不断创新,人工智能技术将更加普及,用户将享受到更高效、更经济的智能服务。返回搜狐,查看更多

阅读 ()
作者声明
含AI生成内容
平台声明
该文观点仅代表作者本人,搜狐号系信息发布平台,搜狐仅提供信息存储空间服务。