[속보] 알리바바, 2.4조 개 매개변수 AI 모델 Qwen3.8-Max 공개… 오픈웨이트로 풀린다

알리바바가 자사 최대 규모의 인공지능 모델인 Qwen3.8-Max를 공개했다. 전체 매개변수 2조 4천억 개, 추론 시 950억 개를 활성화하는 혼합 전문가(MoE) 구조로, 최대 100만 토큰의 컨텍스트 윈도우를 지원한다.


알리바바 Qwen3.8-Max 핵심 사양

  • 전체 매개변수: 2조 4천억 (2.4T)
  • 활성 매개변수: 추론당 약 950억 (95B)
  • 아키텍처: 혼합 전문가 구조 (Mixture of Experts)
  • 컨텍스트 윈도우: 최대 100만 토큰
  • 입력 모달리티: 텍스트, 이미지, 비디오 (멀티모달)
  • API 가격: 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러, 캐시된 입력 100만 토큰당 0.25달러
  • 오픈웨이트: 8월 3일 발표 이후 일주일 내 공개 예정
  • 추론 모드: xhigh(복잡 작업), medium(균형), low(빠른 처리) 중 선택 가능

알리바바는 Qwen3.8-Max가 서양 최고 수준 모델과 대등한 성능을 보이며, 앤스로픽의 Fable 5에 이어 2위라고 주장했다.


16일간 무인 코딩, 논문 재현, 칩 설계까지 증명

Qwen팀은 이 모델의 자율 작업 능력을 입증하기 위해 세 가지 사례를 공개했다.

첫째, 16일간 무인으로 CLI 도구 개발. Qwen3.8-Max는 사용자 요청을 GitHub 이슈로 변환하고, 스스로 코드를 작성해 테스트를 실행한 뒤 개선하는 전 과정을 자동화했다. 인간의 개입 없이 265회 커밋, 127회 풀 리퀘스트, 151개 이슈를 처리했다.

둘째, 연구 논문 재현 및 능가. ‘Unified Data Selection for LLM Reasoning’ 논문을 받은 후, 약 5일간 7,600줄의 코드를 작성하고 33회 GPU 학습을 실행해 논문의 6가지 주요 결과를 모두 재현했다. 여기서 멈추지 않고 자체 아이디어 18개를 테스트해 AIME24 수학 벤치마크에서 논문 원본보다 2.7점 높은 성적을 거뒀다.

셋째, 526개 인간 팀과 경쟁. WWW2025 멀티모달 대화 의도 인식 챌린지에서 45회 제출 끝에 정확도를 0.60에서 0.853로 끌어올려 526개 팀 중 458개 팀을 제쳤다.


칩 설계부터 1년 경영 시뮬레이션까지

암호학 칩 설계: 모델은 초기 8,298개 논리 게이트에서 시작해 약 500회 반복 최적화 끝에 678개까지 줄였다. 물리적 칩 면적은 106×106 마이크로미터에서 46×46으로 81% 축소됐다.

전자상거래 1년 시뮬레이션: 타오바오와 티몰 데이터를 기반으로 10만 위안으로 시작해 1년간 다수의 온라인 매장을 병렬 운영했다. 공급업체와 자연어로 협상하고, 가격을 조정하며, 태풍 같은 위기까지 대처한 결과 잔액이 41만 6,252위안으로 4배 이상 증식했다. 공급업체 중 숨어있는 152명의 사기꾼도 찾아냈다.


배경: 중국 AI가 빠르게 따라붙고 있다

Qwen3.8-Max는 알리바바가 7월 중순 미리보기 버전으로 선보인 이후 약 2주 만에 정식 출시됐다. Qwen3.5 아키텍처를 기반으로 하며, 알리바바는 이 모델의 가중치를 공개해 연구자와 개발자가 자유롭게 활용할 수 있도록 할 예정이다.

미국과 유럽이 AI 규제에 분주한 사이, 중국 기업들이 오픈웨이트 모델을 앞다투어 공개하며 AI 기술의 민주화를 주도하는 모습이다. EU AI법이 8월 2일 발효된 직후, 미국 백악관도 메타, 구글, 오픈AI, 앤스로픽과 AI 안전 규제 논의를 시작했다.

알리바바의 Qwen 시리즈는 이미 글로벌 개발자 커뮤니티에서 널리 사용 중이며, 이번 Qwen3.8-Max의 오픈웨이트 공개는 서양 최고 수준 모델과의 격차를 더욱 좁히는 계기가 될 전망이다.


전망: 에이전트 AI 시대의 본격 개막

Qwen3.8-Max의 가장 큰 의미는 단순한 모델 크기가 아니라 자율성에 있다. 일회성 질문에 답하는 수준을 넘어, 스스로 목표를 세우고 계획하며 실행하고 수정하는 에이전트 AI로의 진화를 보여준다.

오픈웨이트가 공개되면 전 세계 연구자들이 이 모델을 기반으로 의료, 금융, 법률, 교육 등 다양한 분야의 에이전트 시스템을 구축할 수 있게 된다. 다만, 2.4조 개 매개변수를 로컬에서 실행하려면 막대한 컴퓨팅 자원이 필요해 실제 활용은 클라우드 API 중심이 될 것으로 보인다.

SK하이닉스를 비롯한 메모리 반도체 기업들도 에이전트 AI 시대에 맞춘 고대역폭 메모리(HBM) 신제품을 잇따라 선보이며, AI 하드웨어 생태계 전반이 빠르게 재편되고 있다.


자주 묻는 질문

Q. Qwen3.8-Max는 일반 사용자도 쓸 수 있나요?
A. 네, 알리바바의 큐원클라우드(QwenCloud) 플랫폼과 API를 통해 누구나 접근할 수 있습니다. OpenAI 및 앤스로픽 API와 호환되어 기존 코드를 쉽게 전환할 수 있습니다. 오픈웨이트 공개 후에는 로컬 환경에서도 실행할 수 있습니다.

Q. 2.4조 개 매개변수는 구체적으로 얼마나 큰 규모인가요?
A. 인간 뇌의 시냅스 연결이 약 100조 개인 점을 고려하면, 2.4조 개 매개변수는 그 약 2.4%에 해당합니다. 다만 모델이 모든 매개변수를 동시에 사용하지 않고, 혼합 전문가 구조로 질문마다 약 950억 개만 선택적으로 활성화해 효율성을 높였습니다.

Q. 기존 GPT나 클로드 모델과 비교해 어떤가요?
A. 알리바바는 앤스로픽 Fable 5 다음으로 성능이 뛰어나다고 주장합니다. 특히 장기 자율 작업에서 강점을 보이며, 논문 재현, 칩 설계 최적화, 전자상거래 시뮬레이션 등에서 인간 수준 이상의 결과를 입증했습니다.

Q. 오픈웨이트가 공개되면 어떤 장점이 있나요?
A. 개발자가 모델 내부 구조를 확인하고 수정할 수 있어, 맞춤형 파인튜닝과 특정 분야 특화가 가능해집니다. 또한 데이터 프라이버시가 중요한 의료나 금융 분야에서 자체 인프라에 모델을 구축할 수 있습니다.

Q. 한국 AI 산업에는 어떤 영향이 있나요?
A. 한국 기업들도 Qwen3.8-Max의 오픈웨이트를 활용해 자체 AI 에이전트를 구축할 수 있게 됩니다. 특히 통신사, 금융권, 제조업 등에서 비용을 크게 줄이면서도 최고 수준의 AI 기능을 도입할 수 있는 기회가 열렸습니다.

Related Post