정의

Data Source Before Prompt는 정보 자동화와 AI bot의 품질이 prompt 설계보다 먼저 data source의 신뢰도, coverage, 갱신 주기, 접근성을 정하는 데서 출발한다는 원칙이다.

왜 중요한가

LLM은 잘못되거나 빈약한 입력을 안정적인 intelligence로 바꾸지 못한다. NewsAPI, DART, Finnhub, ECOS, RSS처럼 출처와 구조가 명확한 데이터 소스를 먼저 확보해야 요약과 알림도 재현 가능해진다.

적용 질문

  • 이 봇이 다룰 정보의 원천은 무엇인가?
  • API, RSS, scraping 중 어느 방식이 가장 안정적인가?
  • 중복 기사와 stale data를 어떻게 제거할 것인가?
  • LLM은 원문 수집이 아니라 어느 단계의 해석을 맡을 것인가?

출처

클리핑