Pointchecknote
빅테크뉴스작성·검수 한국어English日本語

알리바바 Qwen3.8-Max 정리 2026: 2.4조 MoE·100만 컨텍스트·Terminal-Bench 86.6

알리바바가 8월 4일 공개한 역대 최대 모델 Qwen3.8-Max. 총 2.4조 파라미터 MoE로 답변 시 950억만 활성화, 100만 컨텍스트·멀티모달. Frontend Code Arena 1,668, Terminal-Bench 86.6 등으로 Fable 5·Opus 5에 근접·일부 우위를 주장하며 오픈웨이트로 공개 예정이다.

공유𝕏 포스트

중국발 AI 러시가 또 갱신됐다. 8월 4일 알리바바가 역대 최대 모델 Qwen3.8-Max를 공개했다. 파라미터가 무려 2.4조, 다만 답변할 때는 그중 950억만 활성화하는 MoE 방식이다. 벤치마크로는 앤트로픽 Fable 5와 Claude Opus 5에 근접하거나 일부 앞선다고 주장한다. 핵심만 추렸다.

무엇이 대단한가?

  • 구조: 희소 MoE, 총 2.4조 중 활성 950억 파라미터
  • 컨텍스트: 100만 토큰 — 한 번에 200페이지 넘는 문서, 약 100시간 분량 영상 처리
  • 멀티모달: 텍스트·이미지·영상 입력
  • 알리바바 역대 최대이자 가장 강력한 Qwen

Qwen3.8-Max 공개

“크게 만들되 활성은 일부만”이라는 요즘 대형 모델 흐름의 정점이다. 같은 흐름의 중국 오픈모델은 딥시크 V4 플래시에서 이어진다.

벤치마크 — 어디까지 왔나?

알리바바가 공개한 표 기준이다.

항목 Qwen3.8-Max 메모
Frontend Code Arena 1,668 Opus 5 최상위 구성에 37점 차
PaperBench 93.0 선두
IFBench 82.8 선두
Terminal-Bench 2.1 86.6 Opus 4.8·Fable 5(84.6)보다 앞

벤치마크

코딩·실무형 지표에서 최상위권과 어깨를 나란히 한다는 게 핵심이다. 중국 모델의 부상 흐름은 OpenRouter로 본 AI 순위에서도 읽힌다.

가격과 공개는?

  • 가격(100만 토큰): 입력 $2 / 출력 $6 / 캐시 입력 $0.25
  • 지금은 QwenCloud로 제공, 가중치는 허깅페이스·모델스코프에 오픈웨이트로 공개 예정

가격·공개

상위권 성능을 오픈웨이트로 푼다는 점이 업계에 주는 압박이 크다.

자주 묻는 질문

Q. 파라미터 2.4조인데 왜 빠르다고 하나? MoE(전문가 혼합) 구조라 답변마다 전체가 아니라 약 950억 파라미터만 활성화한다. 그래서 아주 큰 모델이면서도 상대적으로 빠르고 저렴하게 돌 수 있다.

Q. 벤치마크를 그대로 믿어도 되나? 알리바바 자체 공개 수치다. 방향은 분명하지만 독립 벤치마크 검증은 지켜볼 필요가 있다.

Q. 오픈웨이트면 상업적으로 쓸 수 있나? 가중치가 허깅페이스·모델스코프에 공개될 예정이다. 구체 라이선스 조건은 공개 시점에 확인해야 한다.

#Qwen3.8-Max#알리바바#오픈웨이트#중국AI#LLM비교
공유𝕏 포스트

빅테크뉴스 관련 글