返回AI 模型
AI 模型

Anthropic Claude Opus 5亮相:SWE-bench Verified达96%,IMO满分

Anthropic发布Claude Opus 5,在代码生成和数学推理基准上刷新纪录,系统提示词被大幅精简。

0 阅读作者:新品星球编辑部

Anthropic正式发布新一代旗舰模型Claude Opus 5,在多项权威基准上刷新纪录。其中,SWE-bench Verified代码生成测试达到96.0%,2026年IMO全部六道题目裸测满分,显示出极强的代码与数学推理能力。

值得注意的是,Claude Code团队将系统提示词削减了80%以上,但模型性能并未因此下降。这一变化意味着模型对自然指令的理解能力更强,对复杂系统提示的依赖显著降低,部署和调用成本也有望进一步优化。

近期Anthropic因IPO估值话题备受关注,Claude Opus 5的发布为其技术叙事提供了有力支撑。随着OpenAI、xAI、Google等竞争对手密集迭代,顶级大模型在代码、推理和Agent能力上的角逐已进入白热化阶段。

AnthropicClaude Opus 5代码模型SWE-bench

相关推荐