한 줄 정의

AI 에이전트가 결과물을 생성한 후, 스스로 설정된 기준(테스트, 린트, 빌드 등)에 따라 작업 내용을 검증하고 오류를 수정하는 반복적인 자동화 구조를 의미합니다.

핵심 요지

  • AI에게 작업만 지시하지 말고, 그 결과가 올바른지 확인할 수 있는 검증 수단(테스트 코드 작성/실행)을 반드시 함께 지시해야 합니다.
  • 단순 프롬프트 엔지니어링보다 에이전트의 작업 결과를 신뢰할 수 있게 만드는 검증 환경(Harness Engineering) 구축이 중요합니다.

상세

raw/Claude-Code-실무활용법-보리스-관점-정리.md에서 Anthropic의 보리스는 AI 코딩의 핵심으로 ‘스스로 확인하고 고치는 에이전트’로의 전환을 강조합니다. 단순히 기능을 구현하는 지시를 넘어, 테스트 실행을 포함한 루프를 설계할 때 에이전트는 진정한 생산성을 발휘합니다.

예시

  • “기능을 구현하고, 테스트 코드를 작성한 뒤, 테스트를 실행해서 통과 여부를 알려줘.”
  • 클로드 작업 완료 직후 자동으로 npm run test 실행.

충돌

  • [AI 에이전트는 죽었다](file:///Users/railscraft/Obsidian/raw/AI 에이전트는 죽었다. 88퍼센트가 프로덕션 도달 전에 실패하는 이유.md) (검증 없는 자동화의 실패 사례)

관련 노트