개요

에이전트 내부 구조(agent internals)를 주제로 X에 장문 스레드를 연재하는 저술가. 2026년 8월 “Eval Engineering: build the gate that lets your agents merge without you” 6단계 스레드로 에이전트 자동 머지 게이트의 설계 조건을 정리했다.

핵심 정보

  • 활동 채널: X(@hanakoxbt) 장문 스레드, 별도 텔레그램 채널 운영
  • 주제 영역: 에이전트 내부 구조, LLM-as-a-judge 편향, eval 운영, 자율 머지 게이트
  • 서술 방식: 벤치마크 수치와 논문 근거(Zheng et al. 2023 UC Berkeley, Huang et al. ICLR 2024 DeepMind)를 실무 규칙으로 환산하는 형식
  • 핵심 입장: 자율성의 전제는 모델 신뢰가 아니라 증거를 읽는 제약 장치이며, 판정은 되돌리기 비용(blast radius) 기준으로 열려야 한다

주요 발언 / 기여

카드 명세서에 찍히는 모델은 렌트다. 그 주위를 둘러싼 검사관만이 당신이 계속 소유하는 부분이다.

어떤 실패든 영구 테스트로 전환하지 않으면, 당신은 그 실패를 다시 만나게 된다.

관계

출처

클리핑 · x.com