개요
SWE-agent(Yang 외, arXiv:2405.15793, NeurIPS 2024)는 “언어모델 에이전트는 사람과 다른 필요와 능력을 가진 새로운 종류의 컴퓨터 사용자”라는 관점에서 출발한다. 사람이 쓰는 터미널·에디터를 그대로 에이전트에게 주는 대신, 에이전트 전용으로 설계된 **agent-computer interface(ACI)**를 제공하면 성능이 달라진다는 것을 보인 논문이다.
핵심 주장
- 인터페이스 설계는 모델 자체와 별개로 LM 에이전트 성능에 큰 영향을 준다.
- SWE-agent의 커스텀 ACI는 에이전트가 코드 파일을 만들고 수정하고, 저장소를 탐색하고, 테스트/프로그램을 실행하는 능력을 향상시킨다.
- 2026-07-18-swe-bench와 HumanEvalFix에서 평가해 발표 당시 SOTA 성능을 보였고, ACI 설계가 에이전트 행동에 어떤 영향을 주는지 분석했다.
왜 중요한지
“코딩 에이전트 성능은 모델 속성만이 아니다 — 파일 탐색, 편집 프리미티브, 테스트 실행, 컨텍스트 관리 인터페이스가 에이전트 루프의 실질적 능력을 좌우한다”는 결론은 loop-engineering과 2026-05-24-agent-harness-engineering-survey가 반복해서 강조하는 “하네스 설계가 곧 성능”이라는 명제를 학술적으로 뒷받침하는 초기 근거다.