Anthropic Claude 3.5 Sonnet 升级,代码能力超越 GPT-4

权威测评 2026-08-28 03:09 热度 85 · 浏览 1286
摘要
SWE-Bench 测试中 Claude 3.5 Sonnet 得分 49%,超越 GPT-4o 的 42%。
正文
最新 SWE-Bench 评测显示,Claude 3.5 Sonnet 在真实代码修复任务中表现最佳。长上下文处理能力也获得好评。
×

登录后免费使用全部功能

注册即享所有功能免费使用,无次数限制,无任何门槛。

无限 AI 对话
Agent 源码免费下载
Skill/Prompt 免费复制
免费AI诊断 + 需求发布