yozm.tech
피드로 돌아가기
news.hada.ioHOTAI 재작성

Qwen3.8-2.4T-A95B 오픈 웨이트 공개

알리바바의 AI 모델 Qwen이 최상위 모델 'Qwen3.8-Max'의 기반이 되는 'Qwen3.8-2.4T-A95B'의 가중치(weights)를 공개했습니다. 이는 Qwen의 Max급 모델 중 최초의 오픈 웨이트(open-weight) 버전으로, 총 2.4조(2.4T) 파라미터 중 토큰당 950억(95B)을 활성화하는 MoE(Mixture-of-Experts) 구조를 가집니다. 복잡한 코딩, 전문 업무, 장기 에이전트 작업 등 다단계 작업 수행 능력에 중점을 둔 것이 특징입니다.

6시간 전·2026.08.12·읽기 1·neo https://news.hada.io/user/neo

알리바바(Alibaba)의 AI 모델 Qwen이 자사 최상위 모델인 Qwen3.8-Max의 핵심 기반이 되는 'Qwen3.8-2.4T-A95B'의 가중치(weights)를 전격 공개했습니다. 이는 Qwen의 Max급 모델 중 최초로 오픈 웨이트(open-weight) 형태로 제공되는 것으로, 개발자들이 Qwen의 최상위 모델을 자체 인프라에서 직접 실행하고 활용할 수 있게 되었다는 점에서 큰 의미를 가집니다.

Qwen3.8-2.4T-A95B는 총 2.4조(2.4T) 개의 파라미터를 보유하고 있지만, 모든 파라미터를 동시에 사용하는 대신 토큰당 약 950억(95B) 개의 파라미터만 활성화하는 MoE(Mixture-of-Experts) 구조를 채택했습니다. 이는 효율성을 높이면서도 강력한 성능을 유지하기 위한 설계입니다. 특히 이 모델은 단순 추론 성능을 넘어 자율 계획, 도구 실행, 환경 피드백, 재시도 등으로 이어지는 에이전트 실행 능력 강화에 초점을 맞췄습니다. 코딩, 전문 업무, 연구, 장기 에이전트 작업 등 복잡한 다단계 작업을 완수하는 데 특화되어 있으며, 여러 턴에 걸친 작업에서도 추론 맥락을 유지하도록 설계되었습니다. 기본 262K(26만 2천) 토큰의 컨텍스트(context)를 최대 약 1M(100만) 토큰까지 확장할 수 있어 긴 문서나 대화 처리에도 강점을 보입니다.

이번 오픈 웨이트 공개는 최첨단 대규모 언어모델(LLM)의 접근성을 크게 높여 AI 생태계 전반에 활력을 불어넣을 것으로 기대됩니다. 기존에는 API(응용 프로그래밍 인터페이스) 형태로만 접근 가능했던 Max급 모델을 직접 호스팅할 수 있게 되면서, 기업이나 연구 기관은 자체 데이터와 인프라를 활용해 모델을 더욱 세밀하게 제어하고 최적화할 수 있게 됩니다. 이는 특정 산업이나 도메인에 특화된 AI 솔루션을 개발하는 데 유리하며, 비용 효율적인 운영 또한 가능하게 합니다. 다만, 2.4T 규모의 모델은 여전히 대규모 GPU 인프라를 요구하므로, 일반적인 로컬 PC 환경보다는 대규모 컴퓨팅 자원을 가진 곳에서 활용될 가능성이 높습니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
4/10
보통
4점인가

최첨단 모델이지만, 1인이 감당하기에는 인프라 및 기술 장벽이 매우 높습니다.

문제 / 미충족 수요

최첨단 대규모 언어모델(LLM)을 자체 인프라에서 직접 운영하고 특정 목적에 맞게 커스터마이징하려는 수요가 존재합니다.

한국 시장
국내 있음한국에서도 대기업 및 일부 스타트업에서 자체 LLM 구축 및 운영을 시도하고 있으나, 최상위 모델의 오픈 웨이트 활용은 아직 초기 단계입니다.
수익 모델

B2B 솔루션 개발 및 컨설팅 · 돈 내는 주체: 대규모 언어모델을 자체적으로 운영하려는 기업, 연구 기관, 정부 기관

1인 실현 가능성
2/5

모델 규모가 매우 커서 1인이 감당하기 어려운 GPU 인프라와 전문 지식이 필요합니다.

진입 지점 (Wedge)

특정 산업(예: 법률, 의료)에 특화된 Qwen3.8 기반 에이전트 미세조정(fine-tuning) 및 배포 서비스

이번 주 첫 실험

Qwen3.8-2.4T-A95B 모델을 다운로드하고, vLLM/SGLang 등을 활용해 OpenAI 호환 API 형태로 로컬 서버에 배포하는 테스트를 진행합니다.

Original source
이 글은 news.hada.io의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기