AI专业术语
SWE-Agent
SWE-Agent · AI 自动修 Bug 的软件工程师
AgentAI 编程
SWE-
- 定义
- SWE-Agent是AI领域的专业术语。SWE-Agent 是 Princeton 开发的 AI 软件工程 Agent,能自主阅读 GitHub Issue、浏览代码库、编写修复代码并提交 PR。
最后更新:2026-03-18
什么是SWE-Agent?
SWE-Agent 是 Princeton 开发的 AI 软件工程 Agent,能自主阅读 GitHub Issue、浏览代码库、编写修复代码并提交 PR。在 SWE-bench 基准上解决了 12.5% 的真实 Issue。
- 能自主导航代码库、定位 Bug、编写修复
- SWE-bench 是评估代码 Agent 的标准基准
- 2025 年多个 Agent 在 SWE-bench 上超过 50% 解决率
SWE-Agent详解
SWE-Agent 代表了 AI 编程从「辅助补全」到「自主开发」的跨越。它使用专门设计的 Agent-Computer Interface(ACI)与代码环境交互,包括文件浏览、搜索、编辑和测试等操作。SWE-bench 基准包含 2294 个真实的 GitHub Issue,要求 Agent 理解问题描述、定位相关代码、编写修复并通过测试。2025 年最先进的 Agent 已能解决超过 50% 的 Issue,但在复杂的架构级问题上仍然力不从心。
SWE-Agent的应用场景
正式定义
能够自主理解软件问题、浏览代码库并编写修复代码的 AI 软件工程 Agent
应用场景
- 自动修复 GitHub Issue
- 代码审查和 Bug 检测
- 自动化测试生成
常见误区
- SWE-Agent 不能替代人类开发者,复杂问题仍需人工
- SWE-bench 的解决率不等于实际工作中的可靠性
- Agent 生成的代码仍需人工审查
实际案例
📌 SWE-bench 的进化
SWE-bench 解决率从 2024 年初的 12.5%(SWE-Agent)提升到 2025 年的 55%+(Claude Code),一年内提升了 4 倍,但剩余的 45% 是更难的架构级问题。
SWE-Agent的参考来源
关于SWE-Agent的常见问题
- SWE-Agent 能做什么
- 能自动阅读代码仓库、定位 bug、编写修复补丁,在 SWE-bench 基准上解决率持续提升。
- SWE-Agent 和 Copilot 有什么区别
- Copilot 辅助写代码片段,SWE-Agent 能自主完成完整的软件工程任务,包括理解需求、定位问题和提交修复。