개요
에이전트 내부 구조(agent internals)를 주제로 X에 장문 스레드를 연재하는 저술가. 2026년 8월 “Eval Engineering: build the gate that lets your agents merge without you” 6단계 스레드로 에이전트 자동 머지 게이트의 설계 조건을 정리했다.
핵심 정보
- 활동 채널: X(@hanakoxbt) 장문 스레드, 별도 텔레그램 채널 운영
- 주제 영역: 에이전트 내부 구조, LLM-as-a-judge 편향, eval 운영, 자율 머지 게이트
- 서술 방식: 벤치마크 수치와 논문 근거(Zheng et al. 2023 UC Berkeley, Huang et al. ICLR 2024 DeepMind)를 실무 규칙으로 환산하는 형식
- 핵심 입장: 자율성의 전제는 모델 신뢰가 아니라 증거를 읽는 제약 장치이며, 판정은 되돌리기 비용(blast radius) 기준으로 열려야 한다
주요 발언 / 기여
카드 명세서에 찍히는 모델은 렌트다. 그 주위를 둘러싼 검사관만이 당신이 계속 소유하는 부분이다.
어떤 실패든 영구 테스트로 전환하지 않으면, 당신은 그 실패를 다시 만나게 된다.
관계
- 20260809-eval-gate-for-agent-merge — 이 인물이 정식화한 핵심 개념
- 20260508-eugene-yan — 유사 계열: LLM 운영 패턴을 실무 규칙으로 정리하는 저술가