정의
하네스 엔지니어링(Harness Engineering)은 AI 에이전트가 실수를 반복하지 않도록 검증·제어 도구를 설계하는 방법론이다. 에이전트의 행동을 ‘조이는’(harness) 동시에 안전한 실험을 가능하게 하는 구조를 의미한다.
핵심 속성
- 출처: Mitchell Hashimoto(HashiCorp 창립자, Ghostty 개발자)의 블로그 ‘나의 AI 도입 여정’에서 제안됨.
- 목적: 에이전트의 실수 발견 시 재발 방지; 올바른 행동을 스스로 검증할 수 있는 환경 제공.
- 두 가지 축:
- 프롬프팅을 통한 행동 제약
- 프로그래밍 도구(예: Alloy, end-to-end 테스트)를 통한 정적 검증
- 스캐폴딩과의 대비: 스캐폴딩은 ‘도움 계단’(학습·탐험 지원)인 반면, 하네스는 ‘마구’(통제·검증)에 가깝다. 둘은 공존하며 상호보완적이다.
관계
20260607-scaffolding-vs-harness— 하위개념 (스캐폴딩과 대조)20260607-ragnar-loop— 연장 (가설-실험-검증의 피드백 루프와 결합)20260607-mitchell-hashimoto— 인물 (제안자)20260607-alloy-formal-method— 도구 (하네스 구현 사례)- 20260811-prompt-as-thinking-blueprint-10-layers — 연장 (하네스를 Model/Harness/Tools/Environment/Agent Loop 5요소로 분해하고 프롬프트 계층과의 위계를 명시)
인용
“에이전트가 실수를 하는 것을 발견할 때마다 시간을 들여 그 실수를 다시는 하지 않게 만드는 해결책을 설계한다. 엔지니어링한다는 개념으로 하네스 엔지니어링… 프롬프팅이라는 것하고 실제 프로그래밍 도구를 통해서 에이전트가 나쁜 짓을 하는 거를 볼 때마다 다시는 그 짓을 못하게 하는 쪽으로 노력을 하고 있고, 에이전트가 좋은 거를 하고 있는지를 스스로 검증할 수 있게 하도록 어떤 하네스를 제공하고 있다.”