한 줄 요약
"Repository-level context files helpful for coding agents?" 논문을 소개하며, 잘못 작성된 CLAUDE.md/AGENTS.md가 오히려 작업 성공률을 떨어뜨리고 추론 비용을 20% 이상 늘릴 수 있음을 보여주는 영상.
핵심 내용
- 컨텍스트 구조를 시스템 프롬프트(사용자 접근 불가) → 메모리 파일(CLAUDE.md/AGENTS.md) → 유저 프롬프트 → AI 출력물 순으로 정리. 사용자가 조정 가능한 건 메모리 파일과 유저 프롬프트뿐이며, 처음·끝 위치가 가장 높은 우선순위를 가진다고 설명.
- 논문은 세 조건(컨텍스트 파일 없음 / LLM 자동생성 / 사람 직접 작성)을 SW-Bench·자체 제작 "에이전트 벤치"에서 비교.
- LLM이 자동생성한 컨텍스트 파일은 아무것도 주지 않은 경우보다 성공률을 떨어뜨림(에이전트 벤치 약 2%, SW-Bench-Lite 약 0.5% 하락).
- 파일이 없을 때 더 적은 스텝·더 적은 툴 호출로 첫 응답에 도달하고 비용도 낮았음. 컨텍스트 파일이 있으면 코드를 불필요하게 더 넓게 탐색하는 경향 (컨텍스트 부패 관점).
- 단, 사람이 직접 작성한 컨텍스트 파일은 LLM 생성본보다 성공률이 높았고 평균 약 19% 향상(소닛 등 일부 모델은 예외).
- 화자의 해석: 이 논문은 "CLAUDE.md를 아예 없애라"가 아니라 장황한 문서형 CLAUDE.md의 폐해에 관한 것. 불필요한 내용은 스킬로 옮기고, CLAUDE.md엔 매번 꼭 필요한 최소 정보만 남기라는 결론.
주요 주장 / 데이터
- 추론 토큰 추가 사용: GPT-5.2 +22%, 5.1-mini +14% (컨텍스트 파일 처리 비용, 자막상 모델명 추정).
- 컨텍스트 파일이 성공률을 떨어뜨리는 주된 이유: ① 레포에서 에이전트가 쉽게 파악 가능한 정보가 파일과 중복됨, ② 현재 작업과 무관한 규칙(폴더 구조·인증·금지 사항 등)이 잘못된 컨텍스트를 주입해 목표 지향성을 흔듦.
- 현대 에이전트는 서브에이전트 & 에이전트 팀으로 분석을 위임하고 결과만 메인에 회수하므로 컨텍스트를 적게 쓰는데, 거대한 메모리 파일이 이 흐름을 방해한다는 주장.
출처 정보
- URL: https://www.youtube.com/watch?v=c7_ANA1NiS0
- 채널: 코드팩토리 (2026-07-12 yt-dlp 조회로 확인; 기존 표기 '미상')
- 게시/수집 정보: 자막 lang=ko, 재생목록 순번 6
- 재생목록: PLUGinkN1Rwv4KGXiVEmSBzglfAoTxyXd3