생성형 인공지능(AI)을 서비스에 도입하는 기업들이 늘면서, 어떤 AI 모델을 선택할지가 새로운 과제로 떠오르고 있습니다. 각 모델의 성능 차이뿐만 아니라 호출 비용까지 고려해야 하기 때문인데, 이러한 고민을 해결하기 위해 대학생 창업팀 앱토(ABTO)가 실제 서비스 이용자의 반응을 기준으로 AI 모델을 비교하고 선택할 수 있는 서비스를 선보였습니다.
앱토는 개발사가 공개하는 벤치마크 점수보다는 실제 서비스에서 AI가 만들어내는 경제적 가치에 주목합니다. 예를 들어, 같은 기능에 서로 다른 AI 모델을 적용한 뒤 이용자의 결제, 재방문, 체류 시간 등 행동 데이터를 분석하여 어떤 모델이 더 높은 비즈니스 성과를 내는지 평가하는 방식입니다. 이를 통해 기업들은 단순히 성능이 좋은 비싼 모델을 무작정 도입하기보다, 자사 서비스에 가장 적합하고 비용 효율적인 AI 모델을 찾아낼 수 있게 됩니다.
이러한 접근 방식은 AI 모델 선택의 패러다임을 변화시킬 수 있습니다. 기존에는 기술적 성능 지표에 의존했지만, 앱토의 서비스는 사용자 경험과 비즈니스 성과라는 실제적인 관점에서 AI 모델을 평가합니다. 이는 특히 스타트업이나 중소기업처럼 한정된 자원으로 AI를 활용해야 하는 곳에 큰 도움이 될 수 있으며, AI 도입의 성공 가능성을 높이고 불필요한 비용 지출을 줄이는 데 기여할 것으로 보입니다.