개요

조회 164만이라는 @pvncher(Codex DX)의 “Rethinking skills and prompts for GPT-6 Astra”를 @unclejobs.ai가 소화·실천한 6연쓰레드다. 볼트의 2026-09-06-x-agents-md-skills-cleanup-gpt6-astra가 X 원문과 채널 반응을 다뤘다면, 이 노트는 같은 원문을 개인 하네스에 적용한 실행 기록이라는 점에서 짝을 이룬다.

게시물 요지

  • 문제: 스킬마다 이름·설명이 모델 앞에 깔리는데, 너무 많으면 Codex가 설명을 잘라버려 어떤 스킬을 쓸지 모르게 된다. 작성자 자신의 에이전트에도 스킬 25개가 있었다.
  • 스킬 설명 처방: 짧게, “언제 쓰는지만” 분명하게. 나쁜 예 “DB·쿼리·모델·영속성을 다룰 때 사용” → 좋은 예 “마이그레이션 추가·변경, 배포 검토 때 사용”. 스킬 루트는 얇은 안내판으로 두고 세부 문서·스크립트는 가리키기만 한다. 구형 모델용 긴 요리법(Sol·Luna 맞춤 지침)은 Astra를 과하게 묶는다.
  • AGENTS.md 처방: “편집 전에 설계·DB·배포 문서를 읽어라” 같은 전면 낭독 지시를 걷어내고 문서마다 쓸 때를 붙인다. 테스트 재촉 대신 안전한 곳에 허가를 미리 적는다(“로컬 테스트는 일회용 픽스처, 운영 접근 없음… 단계마다 묻지 말고 다시 돌려라”).
  • 모델의 약점: Astra는 경계를 진지하게 받아들여 사람이 허용할 자리에서도 멈출 수 있다. 처방은 완료 정의(“돌려 보고, 살피고, 고쳐라”)를 요청에 포함하는 것. “첫 구현 뒤 검토받으라”는 문장은 조기 정지를 부른다.
  • 작성자의 적용: 스킬 설명 합계 7,465자·최장 975자·“git log” 같은 트리거 문구 39개를 확인하고, 규칙 40줄을 걷어내 “잘 쓴 글 세 편을 앞에 두는” 방식으로 바꿨다.

확인 범위와 한계

  • 저자 1인의 경험담 + 작성자 1인의 적용기로, 벤치마크 수치는 없다. 게시물 스스로 “줄이라는 것이지 비우라는 게 아니다”라고 선을 긋는다.
  • pvncher 원문 자체는 이 노트에서 직접 읽지 않고 Threads 소화를 거쳤다.

관련 위키

검증

  • Threads 게시물을 ego-browser로 2026-09-10에 직접 렌더링해 6개 포스트 전문을 캡처했다.
  • 원문은 raw/articles/2026-09-10-threads-codex-skills-cleanup.md에 보존했고 SHA-256을 기록했다.