최근 안드레이 카르파티(Andrej Karpathy)가 대규모 언어모델(LLM)의 출력을 더 쉽게 이해하는 방법에 대한 팁을 공유하며 큰 관심을 모았습니다. 이에 영감을 받은 한 개발자가 그의 아이디어를 실제 오픈소스 에이전트 스킬인 '메이크-잇-클릭(make-it-click)'으로 구현해 공개했습니다. 이 스킬은 AI가 더 많은 작업을 수행할수록 인간이 그 결과를 이해하고 검토하는 데 더 많은 시간을 할애하게 된다는 문제 의식에서 출발했습니다.
'메이크-잇-클릭'은 AI 출력물을 인간이 가장 빠르게 이해할 수 있는 형식으로 변환하는 것을 목표로 합니다. 이는 마치 '사다리'처럼 작동하는데, 가장 단순한 형식부터 시작해 필요에 따라 점진적으로 복잡한 형식으로 전환합니다. 구체적으로는 항공우주 및 국방 산업에서 사용되는 간결한 기술 영어 표준인 ASD-STE100(Simplified Technical English) 스타일의 엄격하거나 완화된 글쓰기, 플로우차트나 아키텍처 다이어그램, 단계별 설명이 가능한 인터랙티브 HTML 페이지, 그리고 3Blue1Brown 스타일의 내레이션 설명 영상까지 다양한 포맷을 지원합니다. 또한, AI 에이전트의 작업 내용을 검토할 수 있는 '감독 모드(oversight mode)'를 제공하여 무엇이 변경되었고, 그 이유는 무엇이며, 어떤 위험이 있고, 인간이 무엇을 확인해야 하는지 명확하게 제시합니다.
이 스킬은 클로드(Claude.ai)나 클로드 데스크톱 환경에 쉽게 설치하여 사용할 수 있으며, 'TCP 혼잡 제어 방식을 80% STE로 설명해 줘', '그래디언트 디센트(gradient descent)에 대한 인터랙티브 HTML 설명서를 만들어 줘'와 같은 자연어 명령으로 활용할 수 있습니다. 이는 복잡한 기술 개념이나 AI 생성 콘텐츠를 비전문가도 쉽게 이해할 수 있도록 돕는 중요한 도구가 될 수 있습니다. AI의 활용 범위가 넓어질수록 AI가 생성한 결과물을 인간이 효율적으로 이해하고 검증하는 능력은 더욱 중요해질 것이며, '메이크-잇-클릭'과 같은 도구는 이러한 간극을 메우는 데 기여할 것입니다. 특히 교육, 기술 문서 작성, 복잡한 시스템 설명 등 다양한 분야에서 활용 가치가 높을 것으로 예상됩니다.