알리바바 Qwen3.8-Max 정리 2026: 2.4조 MoE·100만 컨텍스트·Terminal-Bench 86.6
알리바바가 8월 4일 공개한 역대 최대 모델 Qwen3.8-Max. 총 2.4조 파라미터 MoE로 답변 시 950억만 활성화, 100만 컨텍스트·멀티모달. Frontend Code Arena 1,668, Terminal-Bench 86.6 등으로 Fable 5·Opus 5에 근접·일부 우위를 주장하며 오픈웨이트로 공개 예정이다.
중국발 AI 러시가 또 갱신됐다. 8월 4일 알리바바가 역대 최대 모델 Qwen3.8-Max를 공개했다. 파라미터가 무려 2.4조, 다만 답변할 때는 그중 950억만 활성화하는 MoE 방식이다. 벤치마크로는 앤트로픽 Fable 5와 Claude Opus 5에 근접하거나 일부 앞선다고 주장한다. 핵심만 추렸다.
무엇이 대단한가?
- 구조: 희소 MoE, 총 2.4조 중 활성 950억 파라미터
- 컨텍스트: 100만 토큰 — 한 번에 200페이지 넘는 문서, 약 100시간 분량 영상 처리
- 멀티모달: 텍스트·이미지·영상 입력
- 알리바바 역대 최대이자 가장 강력한 Qwen

“크게 만들되 활성은 일부만”이라는 요즘 대형 모델 흐름의 정점이다. 같은 흐름의 중국 오픈모델은 딥시크 V4 플래시에서 이어진다.
벤치마크 — 어디까지 왔나?
알리바바가 공개한 표 기준이다.
| 항목 | Qwen3.8-Max | 메모 |
|---|---|---|
| Frontend Code Arena | 1,668 | Opus 5 최상위 구성에 37점 차 |
| PaperBench | 93.0 | 선두 |
| IFBench | 82.8 | 선두 |
| Terminal-Bench 2.1 | 86.6 | Opus 4.8·Fable 5(84.6)보다 앞 |

코딩·실무형 지표에서 최상위권과 어깨를 나란히 한다는 게 핵심이다. 중국 모델의 부상 흐름은 OpenRouter로 본 AI 순위에서도 읽힌다.
가격과 공개는?
- 가격(100만 토큰): 입력 $2 / 출력 $6 / 캐시 입력 $0.25
- 지금은 QwenCloud로 제공, 가중치는 허깅페이스·모델스코프에 오픈웨이트로 공개 예정

상위권 성능을 오픈웨이트로 푼다는 점이 업계에 주는 압박이 크다.
자주 묻는 질문
Q. 파라미터 2.4조인데 왜 빠르다고 하나? MoE(전문가 혼합) 구조라 답변마다 전체가 아니라 약 950억 파라미터만 활성화한다. 그래서 아주 큰 모델이면서도 상대적으로 빠르고 저렴하게 돌 수 있다.
Q. 벤치마크를 그대로 믿어도 되나? 알리바바 자체 공개 수치다. 방향은 분명하지만 독립 벤치마크 검증은 지켜볼 필요가 있다.
Q. 오픈웨이트면 상업적으로 쓸 수 있나? 가중치가 허깅페이스·모델스코프에 공개될 예정이다. 구체 라이선스 조건은 공개 시점에 확인해야 한다.
빅테크뉴스 관련 글
빅테크뉴스DeepSeek V4 Flash 0731 정리 2026: 가격 $0.14/$0.28·100만 컨텍스트·Terminal-Bench 82.7
새 설계 없이 재학습만으로 — 저가·고효율 코딩 모델의 다음 수
빅테크뉴스OpenAI 아스트라(Astra) 정리: 멀티 에이전트 구조·수학 난제 10개·출시 전망
AI가 답변 도구에서 연구 파트너로 — 며칠씩 붙잡고 늘어지는 모델의 등장
빅테크뉴스아마존·애플 실적 정리: AWS +37% 폭등 vs 애플 메모리發 가이던스 쇼크
실적 위크 마무리 — AI로 버는 회사는 +13%, AI에 발목 잡힌 회사는 -7%