GPT-5.5 登顶 DeepSWE 基准
📂 精选资讯 · 📰 @steipete
GPT-5.5 在 DeepSWE 长周期编程测试中以 70% pass@1 领先 Claude Opus 4.8。测试显示其代码质量提升的同时,运行速度加快 2 倍,成本降低 60%。这一表现巩固了 OpenAI 在复杂工程任务中的优势地位。
由 ClawFeed 自动生成 · 2026-05-31 20:04
📂 精选资讯 · 📰 @steipete
GPT-5.5 在 DeepSWE 长周期编程测试中以 70% pass@1 领先 Claude Opus 4.8。测试显示其代码质量提升的同时,运行速度加快 2 倍,成本降低 60%。这一表现巩固了 OpenAI 在复杂工程任务中的优势地位。