AI가 어디까지 행동하게 할 것인가.
AI가 답변만 만들던 시절에는 잘못된 결과를 사람이 읽고 수정할 수 있었다. 그러나 AI가 파일을 수정하고, 데이터베이스를 갱신하고, 시스템에 등록하고, 이메일을 보내고, 다른 에이전트와 협업하기 시작하면 한 번의 잘못된 판단이 현실의 행동으로 이어진다.
《AI 하네스 엔지니어링》은 바로 판단과 행동 사이를 설계하는 책이다. 원고는 AI 하네스 엔지니어링을 AI의 판단을 현실의 행동으로 옮기는 순간 필요한 도구, 권한, 승인, 상태, 실행환경, 자원, 기록, 평가와 복구를 설계하여 행동의 범위와 위험을 통제하는 공학적 접근으로 정의한다.
프롬프트에 “하지 마라”고 적는 것만으로는 실제 행동을 막을 수 없다. 하네스는 위험한 행동을 권한과 승인, 검증, 샌드박스와 같은 시스템 구조로 할 수 없게 만들고, 실패했을 때 어디까지 실행되었는지 추적하며, 재시도·롤백·복구가 가능하도록 설계한다. 원고의 핵심 표현처럼, 프롬프트가 ‘하지 마라’고 말한다면 하네스는 ‘할 수 없게’ 만든다.
도구와 권한에서 시작해 사람의 승인, 실행 상태, 실패 복구, 멀티 에이전트 오케스트레이션, 샌드박스, 비용과 SLO, 관찰가능성, 평가와 거버넌스까지 다룬다.
AI에게 더 많은 일을 맡기는 방법이 아니라, 어디까지 맡겨도 되는지를 설계하는 방법을 다루는 책이다.