알리바바(Alibaba)의 AI 모델 Qwen이 자사 최상위 모델인 Qwen3.8-Max의 핵심 기반이 되는 'Qwen3.8-2.4T-A95B'의 가중치(weights)를 전격 공개했습니다. 이는 Qwen의 Max급 모델 중 최초로 오픈 웨이트(open-weight) 형태로 제공되는 것으로, 개발자들이 Qwen의 최상위 모델을 자체 인프라에서 직접 실행하고 활용할 수 있게 되었다는 점에서 큰 의미를 가집니다.
Qwen3.8-2.4T-A95B는 총 2.4조(2.4T) 개의 파라미터를 보유하고 있지만, 모든 파라미터를 동시에 사용하는 대신 토큰당 약 950억(95B) 개의 파라미터만 활성화하는 MoE(Mixture-of-Experts) 구조를 채택했습니다. 이는 효율성을 높이면서도 강력한 성능을 유지하기 위한 설계입니다. 특히 이 모델은 단순 추론 성능을 넘어 자율 계획, 도구 실행, 환경 피드백, 재시도 등으로 이어지는 에이전트 실행 능력 강화에 초점을 맞췄습니다. 코딩, 전문 업무, 연구, 장기 에이전트 작업 등 복잡한 다단계 작업을 완수하는 데 특화되어 있으며, 여러 턴에 걸친 작업에서도 추론 맥락을 유지하도록 설계되었습니다. 기본 262K(26만 2천) 토큰의 컨텍스트(context)를 최대 약 1M(100만) 토큰까지 확장할 수 있어 긴 문서나 대화 처리에도 강점을 보입니다.
이번 오픈 웨이트 공개는 최첨단 대규모 언어모델(LLM)의 접근성을 크게 높여 AI 생태계 전반에 활력을 불어넣을 것으로 기대됩니다. 기존에는 API(응용 프로그래밍 인터페이스) 형태로만 접근 가능했던 Max급 모델을 직접 호스팅할 수 있게 되면서, 기업이나 연구 기관은 자체 데이터와 인프라를 활용해 모델을 더욱 세밀하게 제어하고 최적화할 수 있게 됩니다. 이는 특정 산업이나 도메인에 특화된 AI 솔루션을 개발하는 데 유리하며, 비용 효율적인 운영 또한 가능하게 합니다. 다만, 2.4T 규모의 모델은 여전히 대규모 GPU 인프라를 요구하므로, 일반적인 로컬 PC 환경보다는 대규모 컴퓨팅 자원을 가진 곳에서 활용될 가능성이 높습니다.