알리바바(Alibaba)가 개발한 오픈 가중치 대규모 언어모델(LLM) 콴원 3.8 27B(Qwen3.8 27B)가 인공지능 분석(Artificial Analysis) 플랫폼의 최신 평가에서 뛰어난 지능(Intelligence) 점수를 기록하며 주목받고 있습니다. 이 모델은 인텔리전스 지수(Intelligence Index)에서 52점을 획득, 비교 대상 모델들의 중앙값인 9점을 훨씬 상회하며 상위 1%에 해당하는 성능을 보여주었습니다.
콴원 3.8 27B는 270억 개의 매개변수(parameter)를 가진 모델로, 텍스트와 이미지 입력을 모두 지원하는 멀티모달(multimodal) 기능을 갖추고 있습니다. 특히 256k 토큰에 달하는 매우 긴 컨텍스트 창(context window)을 제공하여, 방대한 양의 정보를 한 번에 처리하고 복잡한 추론(reasoning) 작업을 수행할 수 있습니다. 이는 약 384페이지 분량의 A4 문서를 한 번에 이해할 수 있는 수준입니다. 또한, 이 모델은 아파치 2.0(Apache 2.0) 라이선스로 공개되어 상업적 활용이 자유롭고, 비용 역시 무료로 제공되어 접근성이 매우 높습니다.
이번 평가는 GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1 등 9가지의 다양한 벤치마크를 통해 모델의 지능, 추론 능력, 코딩, 장문 이해력 등을 종합적으로 측정했습니다. 콴원 3.8 27B는 이러한 평가에서 높은 점수를 받으며, 특히 방대한 출력 토큰(1억 6천만 토큰)을 생성하는 뛰어난 장황성(verbosity)을 보여주었습니다. 이는 사용자가 원하는 정보를 더욱 풍부하고 상세하게 제공할 수 있음을 의미합니다. 오픈 가중치 모델로서 이 정도의 성능과 기능을 무료로 제공한다는 점은 대규모 언어모델 생태계에 큰 영향을 미 미칠 것으로 예상됩니다. 개발자들은 고성능 AI 모델을 비용 부담 없이 활용하여 혁신적인 애플리케이션을 구축할 수 있게 될 것입니다.