LELexEdge词汇锋面
AI专业术语

SWE-Agent

SWE-Agent · AI 自动修 Bug 的软件工程师

AgentAI 编程
SWE-
定义
SWE-AgentAI领域的专业术语SWE-Agent 是 Princeton 开发的 AI 软件工程 Agent,能自主阅读 GitHub Issue、浏览代码库、编写修复代码并提交 PR。

最后更新:2026-03-18

什么是SWE-Agent?

SWE-Agent 是 Princeton 开发的 AI 软件工程 Agent,能自主阅读 GitHub Issue、浏览代码库、编写修复代码并提交 PR。在 SWE-bench 基准上解决了 12.5% 的真实 Issue。

  • 能自主导航代码库、定位 Bug、编写修复
  • SWE-bench 是评估代码 Agent 的标准基准
  • 2025 年多个 Agent 在 SWE-bench 上超过 50% 解决率

SWE-Agent详解

SWE-Agent 代表了 AI 编程从「辅助补全」到「自主开发」的跨越。它使用专门设计的 Agent-Computer Interface(ACI)与代码环境交互,包括文件浏览、搜索、编辑和测试等操作。SWE-bench 基准包含 2294 个真实的 GitHub Issue,要求 Agent 理解问题描述、定位相关代码、编写修复并通过测试。2025 年最先进的 Agent 已能解决超过 50% 的 Issue,但在复杂的架构级问题上仍然力不从心。

SWE-Agent的应用场景

正式定义

能够自主理解软件问题、浏览代码库并编写修复代码的 AI 软件工程 Agent

应用场景

  • 自动修复 GitHub Issue
  • 代码审查和 Bug 检测
  • 自动化测试生成

常见误区

  • SWE-Agent 不能替代人类开发者,复杂问题仍需人工
  • SWE-bench 的解决率不等于实际工作中的可靠性
  • Agent 生成的代码仍需人工审查

实际案例

📌 SWE-bench 的进化

SWE-bench 解决率从 2024 年初的 12.5%(SWE-Agent)提升到 2025 年的 55%+(Claude Code),一年内提升了 4 倍,但剩余的 45% 是更难的架构级问题。

关于SWE-Agent的常见问题

SWE-Agent 能做什么
能自动阅读代码仓库、定位 bug、编写修复补丁,在 SWE-bench 基准上解决率持续提升。
SWE-Agent 和 Copilot 有什么区别
Copilot 辅助写代码片段,SWE-Agent 能自主完成完整的软件工程任务,包括理解需求、定位问题和提交修复。

与SWE-Agent相关的术语

AI AgentClaude CodeCopilot