최근 한 개발자가 Liquid AI의 450M 파라미터 소형 모델을 미세조정(fine-tuning)하여 아날로그 시계 읽기라는 특정 시각 작업에서 놀라운 성과를 달성했습니다. 이 모델은 'Time Wizard'라는 이름으로 공개되었으며, GPT-5.6 Sol과 유사한 정확도를 보이고 Fable 5.1을 능가하는 성능을 입증하며, 특정 분야에서 대규모 모델(LLM)의 비효율성을 다시 한번 조명했습니다.
개발자는 아날로그 시계 읽기처럼 명확하게 정의된 작업을 위해 소형 모델을 저렴하고 확장 가능하게 미세조정하는 방법을 탐구했습니다. 기존의 대규모 언어 모델들은 이러한 시각적 추론 작업, 특히 미묘한 시계 바늘의 위치를 정확히 파악하는 데 취약점을 보여왔습니다. Time Wizard는 Liquid AI의 LFM2.5-VL-450M 모델을 기반으로 훈련되었으며, 1분 이내 정확도 59%, 정확한 분 단위 정확도 31%, 시간 단위 정확도 74.5%를 기록했습니다. 이는 기존의 거대 모델들이 어려움을 겪는 영역에서 작은 모델이 효율적인 훈련을 통해 충분히 경쟁력을 가질 수 있음을 시사합니다.
이러한 결과는 특정 도메인에 특화된 소형 모델의 잠재력을 강조합니다. 모든 작업을 하나의 거대 모델로 해결하려는 접근 방식 대신, 비용 효율적이고 빠르게 훈련 가능한 소형 모델들이 특정 니치(niche) 시장에서 강력한 대안이 될 수 있음을 보여줍니다. 이는 AI 개발 및 배포의 민주화를 촉진하고, 자원 제약이 있는 개발자나 기업도 고성능 AI 솔루션을 구축할 수 있는 길을 열어줄 수 있습니다. 또한, 불필요하게 큰 모델을 사용하는 대신 작업에 최적화된 모델을 선택함으로써 컴퓨팅 자원과 에너지 소비를 줄이는 데 기여할 수 있습니다.