정의

하네스 엔지니어링(Harness Engineering)은 AI 에이전트가 실수를 반복하지 않도록 검증·제어 도구를 설계하는 방법론이다. 에이전트의 행동을 ‘조이는’(harness) 동시에 안전한 실험을 가능하게 하는 구조를 의미한다.

핵심 속성

  • 출처: Mitchell Hashimoto(HashiCorp 창립자, Ghostty 개발자)의 블로그 ‘나의 AI 도입 여정’에서 제안됨.
  • 목적: 에이전트의 실수 발견 시 재발 방지; 올바른 행동을 스스로 검증할 수 있는 환경 제공.
  • 두 가지 축:
    • 프롬프팅을 통한 행동 제약
    • 프로그래밍 도구(예: Alloy, end-to-end 테스트)를 통한 정적 검증
  • 스캐폴딩과의 대비: 스캐폴딩은 ‘도움 계단’(학습·탐험 지원)인 반면, 하네스는 ‘마구’(통제·검증)에 가깝다. 둘은 공존하며 상호보완적이다.

관계

  • 20260607-scaffolding-vs-harness — 하위개념 (스캐폴딩과 대조)
  • 20260607-ragnar-loop — 연장 (가설-실험-검증의 피드백 루프와 결합)
  • 20260607-mitchell-hashimoto — 인물 (제안자)
  • 20260607-alloy-formal-method — 도구 (하네스 구현 사례)
  • 20260811-prompt-as-thinking-blueprint-10-layers — 연장 (하네스를 Model/Harness/Tools/Environment/Agent Loop 5요소로 분해하고 프롬프트 계층과의 위계를 명시)

인용

“에이전트가 실수를 하는 것을 발견할 때마다 시간을 들여 그 실수를 다시는 하지 않게 만드는 해결책을 설계한다. 엔지니어링한다는 개념으로 하네스 엔지니어링… 프롬프팅이라는 것하고 실제 프로그래밍 도구를 통해서 에이전트가 나쁜 짓을 하는 거를 볼 때마다 다시는 그 짓을 못하게 하는 쪽으로 노력을 하고 있고, 에이전트가 좋은 거를 하고 있는지를 스스로 검증할 수 있게 하도록 어떤 하네스를 제공하고 있다.”

출처

클리핑 · YouTube