Gemini 3.8 Flash vs Muse Spark 1.3 비교 2026: 공식 가격 $0.75/$3.75 vs $1.25/$4.25, 메타 max 모드는 아직 못 쓴다
구글 Gemini 3.8 Flash와 메타 Muse Spark 1.3이 2026년 9월 2일 몇 시간 차이로 나왔다. 두 회사 공식 가격 페이지를 직접 열어 확인한 숫자와, 메타 홍보 점수가 아직 호출할 수 없는 max 모드 기준이라는 사실을 정리했다.
새 모델이 나오면 보통 벤치마크 표부터 본다. 그런데 이번엔 순서를 바꿔봤다. 9월 2일 구글이 Gemini 3.8 Flash를 공개하고 몇 시간 뒤 메타가 Muse Spark 1.3을 올렸는데, 두 회사 공식 가격 페이지를 직접 열어보니 Gemini 3.8 Flash는 100만 토큰당 입력 $0.75·출력 $3.75, Muse Spark 1.3은 $1.25·$4.25였다. 다만 구글 쪽 숫자는 2026년 12월 31일까지만 유효하고 2027년 1월 1일부터 정확히 두 배가 된다. 이 한 줄이 이 글의 결론에 가깝다.

구글이 6주 만에 세 번째 Flash를 낸 이유
구글 공식 발표문에 릴리스 속도가 그대로 적혀 있다. 3.7 Flash가 3주 전이었고 이번이 6주 만의 세 번째 Flash다. 모델을 크게 키우는 대신 같은 속도·같은 가격대에서 추론과 코딩을 끌어올리는 쪽을 택했다는 뜻이다.
이번엔 두 갈래다. 하나는 긴 호흡의 소프트웨어 엔지니어링과 자율 에이전트를 겨냥한 3.8 Flash, 다른 하나는 취약점 탐지와 자동 패치에 특화된 3.8 Flash Cyber다. 후자는 아무나 못 쓴다. ‘Fairwind 프로그램’ 승인을 받은 정부 기관·핵심 인프라 운영자·소프트웨어 메인테이너에게만 열린다.
숫자로 보면 3.8 Flash는 HLE-Verified에서 54.9%를 기록했고, Cyber 쪽은 20개 언어 코드베이스를 대상으로 한 내부 벤치마크에서 성공률 70%를 넘겼다. 실제 적용 사례도 구체적이다. 크롬 보안팀은 훨씬 큰 상용 모델보다 정확한 패치를 2.6배 많이 얻었고, 구글 클라우드 취약점 연구팀은 보통 몇 달 걸리던 발견을 2시간 안에 해냈다고 한다.
가격표를 직접 열어보면 뭐가 다른가?
여기서부터가 실측이다. Gemini API 가격 페이지의 3.8 Flash 항목은 이렇게 되어 있다.

입력 $0.75, 출력 $3.75, 컨텍스트 캐싱 $0.075 — 전부 “through December 31, 2026”이라는 단서가 붙어 있고, 바로 아래 줄에 2027년 1월 1일부터 $1.50 / $7.50 / $0.15가 적혀 있다. 무료 티어도 여전히 존재한다.
메타 쪽 공식 페이지의 ‘Models and pricing’ 표도 그대로 옮기면 이렇다.

| 모델 | 컨텍스트 | 입력(1M) | 캐시 입력 | 출력(1M) |
|---|---|---|---|---|
| muse-spark-1.3 | 1M | $1.25 | $0.15 | $4.25 |
| muse-spark-1.3-contributor | 1M | $0.10 | $0.002 | $0.20 |
| gemini-3.8-flash | — | $0.75 → $1.50 | $0.075 → $0.15 | $3.75 → $7.50 |
contributor 티어가 눈에 띄게 싸다. 대신 표 아래에 “Used to improve our products”라고 명시돼 있다. 프롬프트가 학습에 쓰인다는 뜻이니, 사내 코드나 고객 데이터를 태우는 파이프라인이라면 이 줄부터 읽어야 한다. 참고로 두 회사 모두 가격은 USD 기준이고 결제 시 환율·세금은 지역마다 달라진다.
메타의 1754점, 그대로 믿어도 되나?
메타 공식 페이지의 벤치마크 표는 화려하다. GDPval-AA v2 1754, DeepSWE v1.1 75.4, Terminal-Bench 2.1 88.8, MRCR 512K–1M 98.1. 1.2 세대의 1615에서 확실히 뛰었다.
문제는 열 제목이다. 이 점수들은 전부 (max) 기준인데, max 추론 모드는 추가 안전성 테스트가 끝나지 않아 아직 개발자에게 열려 있지 않다. 오늘 API로 부를 수 있는 건 한 단계 아래인 xhigh다. 지난달 Muse Spark 1.2를 정리했을 때와 구도가 비슷하다. 발표 자료의 최고 점수와 손에 쥐는 모델이 한 칸씩 어긋나 있다.
실제로 부를 수 있는 등급끼리 붙이면 격차는 훨씬 작아진다. 제3자 측정 기관 Artificial Analysis 기준으로 Muse Spark 1.3 xhigh는 지능 지수 61에 작업당 $0.55, Gemini 3.8 Flash(high)는 59에 $0.58이다. 속도는 구글이 초당 305토큰으로 메타의 235토큰보다 약 30% 빠르다.
한국어 문서에는 3.8이 아직 없다
작은 발견 하나. Gemini API 가격 페이지를 한국어로 열면 모델 목록이 3.6 Flash에서 끊긴다. 3.7도 3.8도 없다. 일본어도 마찬가지고, 영어로 전환해야 3.8 Flash 표가 나타난다. 여러분이 최신 모델 단가를 확인할 일이 있다면 언어를 영어로 바꾸고 보는 편이 안전하다. 번역 문서는 며칠에서 몇 주씩 늦는다.
그래서 어느 쪽을 골라야 하나
에이전트를 오래 굴리는 워크로드라면 지금은 구글이 싸고 빠르다. 다만 원가표를 짤 때 $0.75를 고정값으로 넣으면 1월에 계산이 어긋난다. 도입가라는 사실을 계약서와 스프레드시트 양쪽에 적어두는 편이 낫다.
반대로 프롬프트가 학습에 쓰여도 상관없는 실험·사이드 프로젝트라면 메타 contributor 티어의 $0.10 / $0.20은 비교 대상이 없다. 코딩 에이전트를 붙여 쓰는 흐름은 커서(Cursor) 정리 글과, 데스크톱에서 모델을 굴리는 감각은 Gemini Spark macOS 글에서 이어진다.
자주 묻는 질문
Q. Gemini 3.8 Flash 가격은 얼마인가? 공식 가격 페이지 기준 100만 토큰당 입력 $0.75, 출력 $3.75다. 단 2026년 12월 31일까지의 도입가이고, 2027년 1월 1일부터 $1.50 / $7.50으로 오른다고 같은 페이지에 명시돼 있다.
Q. Muse Spark 1.3이 Gemini 3.8 Flash보다 성능이 좋은가? 메타가 공개한 최고 점수(GDPval-AA v2 1754 등)는 아직 호출할 수 없는 max 모드 기준이다. 현재 API로 쓸 수 있는 xhigh와 Gemini 3.8 Flash를 제3자 기관이 붙여보면 지능 지수 61 대 59로 거의 붙어 있고, 속도는 구글이 30%가량 빠르다.
Q. contributor 티어를 써도 되나? 입력 $0.10·출력 $0.20으로 매우 저렴하지만 메타 공식 표에 “제품 개선에 사용됨”이라고 적혀 있다. 프롬프트가 학습에 활용된다는 뜻이므로 민감한 코드·고객 데이터에는 권하지 않는다.
빅테크뉴스 관련 글
빅테크뉴스메타 Muse Spark 1.2·Muse Code 정리 2026: 터미널 코딩 에이전트·가격·서브에이전트
코딩 에이전트 경쟁 본격화 — 메타도 터미널로 들어왔다
빅테크뉴스알리바바 Qwen3.8-Max 정리 2026: 2.4조 MoE·100만 컨텍스트·Terminal-Bench 86.6
중국 오픈웨이트가 프런티어를 따라붙는 속도가 진짜 뉴스
빅테크뉴스DeepSeek V4 Flash 0731 정리 2026: 가격 $0.14/$0.28·100만 컨텍스트·Terminal-Bench 82.7
새 설계 없이 재학습만으로 — 저가·고효율 코딩 모델의 다음 수