커뮤니티 입장하기

큐원(Qwen) 모델 패밀리 구분, 3.8과 Max와 Flash와 이미지와 TTS

큐원은 알리바바 클라우드 Qwen 팀이 만드는 AI 모델 계열의 이름이고, 언어 모델인 Qwen3.8 세대와 이미지 생성 모델인 Qwen-Image, 음성 합성 모델인 Qwen3-TTS가 같은 이름 아래 있습니다. 같은 세대 안에서도 27B와 Flash-Next와 Max는 크기와 실행 위치와 라이선스가 다릅니다.

같은 말:큐원 모델Qwen 3.8Qwen3.8 27BQwen Max Flash 차이알리바바 AI 모델

새로 올라온 개념이에요. 먼저 읽어 보고 퀴즈도 풀어 보세요
Share
목차
  1. 🤔 같은 큐원인데 어떤 것을 받아야 하는지 헷갈릴 때
  2. 🔑 큐원 모델 패밀리의 정의
  3. 🔤 큐원 이름 읽는 법
  4. 🧩 Qwen3.8 세대의 언어 모델 세 가지
  5. ☁️ Max는 API가 중심입니다
  6. 🎨 Qwen-Image와 Qwen3-TTS
  7. 🔜 Qwen4는 아직 없습니다
  8. ⚠️ 자주 하는 실수
  9. ❓ 자주 묻는 질문
  10. 📋 3줄 요약
  11. 참고 자료

🤔 같은 큐원인데 어떤 것을 받아야 하는지 헷갈릴 때

허깅페이스에서 Qwen을 검색하면 27B, Flash-Next, 2.4T-A95B, Image-2.1, TTS처럼 이름이 여러 줄 나옵니다. 전부 알리바바 큐원 팀이 만들었는데 어떤 것은 개인 컴퓨터에서 돌아가고 어떤 것은 API로만 쓰며, 라이선스도 셋이 다릅니다. 이름에 Flash가 붙어 가벼울 것 같은 모델이 실제로는 27B보다 훨씬 무겁기도 합니다.

큐원 이름을 읽는 법, 2026년 9월 기준 Qwen3.8 세대의 세 언어 모델이 무엇이 다른지, 이미지와 음성 모델은 어떤 조건인지, 개인 장비에서 무엇을 고르면 되는지를 정리했습니다. 2026년 9월 28일에 확인한 공식 모델 카드와 발표를 기준으로 적었습니다.

🔑 큐원 모델 패밀리의 정의

큐원(Qwen)은 알리바바 클라우드 Qwen 팀이 만드는 AI 모델 계열의 이름이고, 언어 모델인 Qwen3.8 세대와 이미지 생성 모델인 Qwen-Image, 음성 합성 모델인 Qwen3-TTS가 같은 이름 아래 있습니다.

큐원이 로컬 AI 입문에서 자주 나오는 이유는 두 가지입니다. 하나는 가중치를 공개한 모델이 많아 개인 장비에서 돌릴 선택지가 넓다는 것이고, 다른 하나는 실제로 많이 쓰인다는 것입니다. 2026년 9월 기준 허깅페이스 텍스트 생성 모델 다운로드 순위 1위가 Qwen3-0.6B이고 상위 20개 가운데 큐원 공식 계정 모델이 여덟 개입니다.

🔤 큐원 이름 읽는 법

이름은 세대와 크기와 용도가 순서대로 붙습니다.

이름 조각뜻예
3.8, 3.5, 4세대. 숫자가 클수록 최근Qwen3.8, Qwen4
27B, 0.6B파라미터 수. B는 10억 개27B는 270억 개
2.4T-A95B총 2조 4천억 개 가운데 토큰마다 950억 개만 계산하는 MoEQwen3.8-2.4T-A95B
Max, Plus, FlashAPI 서비스 등급. Max가 가장 크고 Flash가 가장 싸고 빠름Qwen3.8-Max, Qwen3.8-Flash
Next다음 세대 구조를 미리 여는 실험판Qwen3.8-Flash-Next
VL, Image, TTS용도. 시각 언어, 이미지 생성, 음성 합성Qwen3-VL, Qwen-Image-2.1, Qwen3-TTS
0902같은 모델을 그 날짜 기준으로 저장한 판Qwen3.8-Max-0902

A가 붙은 표기가 MoE(전문가 혼합) 구조를 뜻합니다. 파라미터를 잔뜩 갖춰 두되 토큰 하나를 처리할 때는 일부만 계산에 넣는 방식이라, 앞의 숫자가 메모리를 정하고 A 뒤의 숫자가 속도를 정합니다. A가 없는 27B는 파라미터를 전부 쓰는 조밀형(dense)입니다. 이 차이가 실행 조건에 어떻게 이어지는지는 하드웨어 기초에 있습니다.

🧩 Qwen3.8 세대의 언어 모델 세 가지

2026년 8월에 나온 Qwen3.8 세대는 이름이 비슷한 세 모델이 쓰임새가 다릅니다.

항목Qwen3.8-27BQwen3.8-Flash-NextQwen3.8-Max (2.4T-A95B)
공개2026년 8월2026년 8월 26일API 8월 3일, 가중치 8월 8일
총 파라미터270억1,250억 + N-gram 임베딩 510억 + MTP 40억2조 4천억
토큰당 활성270억 전체60억950억
구조조밀형 하이브리드 64층MoE, 전문가 512개 가운데 11개 활성MoE
입력텍스트, 이미지, 영상텍스트, 이미지, 영상가중치판은 텍스트, API판은 이미지와 영상까지
컨텍스트26만, 100만까지 확장26만, 100만까지 확장100만
라이선스Apache 2.0Qwen 커뮤니티 1.0Qwen3.8-Max 라이선스
4비트 필요 메모리16에서 19GB약 112GB개인 장비 범위 밖
주로 쓰는 곳개인 컴퓨터대용량 통합 메모리 장비 또는 APIAPI

이름만 보면 Flash가 가벼울 것 같은데 반대입니다. Flash-Next는 토큰마다 계산에 쓰는 파라미터가 60억 개뿐이라 연산은 가볍지만, 계산에 참여하지 않는 N-gram 임베딩 표까지 1,800억 개가 메모리에 올라가야 합니다. Unsloth 문서 기준으로 1비트로 줄여도 75GB, 4비트는 112GB가 필요합니다. 그래서 개인 장비에서 직접 돌릴 언어 모델은 27B가 현실적이고, 준이아빠블로그에서 24GB 맥에 올려 본 기록과 Flash-Next 구조 정리가 따로 있습니다.

이름을 하나 더 알아 둡니다. 가중치를 공개한 실험판이 Flash-Next이고, 알리바바 API에서 파는 정식판은 qwen3.8-flash라는 이름의 Qwen3.8-Flash입니다. 100만 토큰당 입력 0.16달러와 출력 0.47달러로 2026년 8월 27일 확인한 값이고, 이 판의 가중치는 따로 공개되지 않았습니다.

☁️ Max는 API가 중심입니다

Qwen3.8-Max는 2조 4천억 파라미터 MoE 모델이고 API 가격은 100만 토큰당 입력 2달러, 출력 6달러입니다. 2026년 9월 2일에는 코딩과 협업 작업을 추가 학습한 Qwen3.8-Max-0902가 API에 올라왔는데, 이 0902판은 가중치가 공개되지 않아 API로만 씁니다.

기반 모델의 가중치는 Qwen3.8-2.4T-A95B라는 이름으로 8월 8일 공개됐습니다. 라이선스 항목이 other로 표시된 자체 조건이고 상업 이용은 기본으로 허용되지만, 2조 4천억 개를 자체 서버에서 돌리려면 장비 요구 수준이 개인이나 소규모 팀 범위를 넘습니다. 가중치가 공개됐다는 것과 개인이 로컬에서 쓸 수 있다는 것은 다른 이야기입니다. 성능과 가격은 Qwen3.8-Max 정리에 있습니다.

🎨 Qwen-Image와 Qwen3-TTS

언어 모델 밖의 두 계열입니다.

항목Qwen-Image-2.1Qwen3-TTS
하는 일이미지 생성과 편집문장을 음성으로 합성, 목소리 복제
공개2026년 9월 20일2026년 1월 22일
규모시각 생성부 7B, 텍스트 인코더 8B, 내려받기 33GB0.6B와 1.7B
특징프롬프트로 배경이 비어 있는 RGBA 이미지 생성, 참조 이미지 10장한국어 포함 10개 언어, 녹음 3초 안팎으로 목소리 복제
라이선스Qwen 연구 라이선스, 비상업 용도만Apache 2.0
실행 도구컴피UI, Diffusers파이토치, 맥에서는 MPS로 실행

Qwen-Image 계열은 직전 모델까지 여섯 개가 Apache 2.0이었는데 2.1에서 처음으로 연구 라이선스로 바뀌어 상업 이용에 별도 계약이 필요합니다. 결과물을 판매나 광고에 쓴다면 Apache 2.0으로 남아 있는 직전 모델 Qwen-Image-2512를 쓰는 방법이 있습니다. 자세한 조건은 Qwen-Image-2.1 라이선스 정리에, 컴피UI에서 이미지 모델을 돌리는 방법은 컴피UI 이해하기에 있습니다.

Qwen3-TTS는 Base 모델을 받아야 내 목소리를 복제할 수 있고, CustomVoice와 VoiceDesign은 미리 들어 있는 목소리나 글로 묘사한 목소리를 씁니다. 준이아빠블로그에서 24GB 맥미니로 제로샷 복제와 미세조정까지 해 본 기록이 있습니다.

🔜 Qwen4는 아직 없습니다

Qwen4는 2026년 9월 28일 기준으로 가중치도 사양도 공개되지 않았습니다. Flash-Next의 설정 파일에 qwen4_exp라는 구조 이름이 먼저 들어와 있고, 모델 카드가 이 모델을 Qwen4를 떠받칠 구조의 실험적 공개라고 적었으며, 9월 22일 알리바바가 Qwen4가 학습 단계에 들어갔다고 밝혔다는 보도가 있습니다. 출시일과 크기와 라이선스는 어디에도 없으므로, 지금 로컬에서 쓸 모델은 3.8 세대에서 고릅니다. 세대가 올라가며 자체 라이선스 조건을 붙이는 방향이 보이므로, Qwen4가 나오면 성능보다 라이선스부터 확인하는 편이 안전합니다.

⚠️ 자주 하는 실수

  • Flash를 가벼운 모델로 봅니다: Flash-Next는 4비트로도 112GB가 필요합니다. 개인 장비용은 27B입니다.
  • Max 가중치를 로컬에서 돌리려 합니다: 2조 4천억 개라 개인 장비 범위 밖이고, 0902판은 가중치 자체가 없습니다.
  • 큐원 모델은 다 Apache 2.0이라고 봅니다: 27B와 TTS만 Apache 2.0이고 Flash-Next와 Max와 Image-2.1은 각각 다른 자체 조건입니다. 라이선스 확인법을 따릅니다.
  • API 이름과 가중치 이름을 섞습니다: API의 qwen3.8-flash와 가중치의 Qwen3.8-Flash-Next는 다른 판입니다.

❓ 자주 묻는 질문

큐원 모델의 한국어 성능은 어떤가요?

Qwen3.8 27B는 한국어를 포함한 다국어를 지원하고 준이아빠블로그의 실측에서도 한국어 질문에 답했습니다. 다만 한국어 실무 산출물을 따로 재는 벤치마크에서는 업스테이지 Solar Open 2 같은 국산 모델이 앞선 항목이 있습니다. 한국어 문서를 많이 처리한다면 두 계열을 같은 문서로 돌려 보고 정하는 편이 정확합니다.

큐원 모델의 벤치마크 점수는 믿어도 되나요?

발표 자료의 점수는 알리바바가 직접 낸 값이고 비교 대상 모델의 점수는 각 회사가 선호하는 방식으로 잰 값이라, 같은 조건에서 나란히 돌린 결과가 아닙니다. 사람이 투표하는 Arena 순위 같은 제3자 측정을 함께 보고, 쓰려는 작업 한두 개를 골라 직접 돌려 보는 편이 표를 읽는 것보다 정확합니다.

큐원이 다른 회사 모델을 증류했다는 말은 사실인가요?

2026년 9월 8일 미국 정부 기관 세 곳이 낸 권고문이 알리바바를 지목한 것은 사실입니다. 다만 권고문이 적은 대상은 2025년 말의 Claude 4 계열과 GPT-5이고, 이 수치와 주장은 한쪽 당사자의 발표라 제3자 검증은 아직 없습니다. 이 일로 제기된 소송이나 제재는 확인되지 않습니다. 증류가 무엇인지는 AI 모델 증류 정리에 있습니다.

큐원 대신 볼 만한 오픈 웨이트 모델은 무엇인가요?

Z.ai의 GLM 계열은 GLM-5.3-Flash가 MIT 라이선스이고, 딥시크 V4 계열도 MIT입니다. 국산으로는 업스테이지 Solar Open 2가 있는데 250B 규모라 H200 GPU 4장 이상이 필요해 개인 장비에서는 돌리기 어렵습니다. 크기별로 무엇이 어느 장비에 올라가는지는 모델 크기 고르기에 표로 있습니다.

📋 3줄 요약

  1. 큐원은 알리바바 클라우드 Qwen 팀의 모델 계열 이름이고 Qwen3.8 언어 모델과 Qwen-Image 이미지 모델과 Qwen3-TTS 음성 모델이 같은 이름 아래 있습니다.

  2. 같은 Qwen3.8 세대에서 27B는 조밀형 270억 개에 Apache 2.0, Flash-Next는 MoE 1,250억 개에 활성 60억 개와 커뮤니티 라이선스, Max는 2조 4천억 개 MoE에 API 중심이라 셋의 실행 위치와 조건이 다릅니다.

  3. 개인 장비에서 직접 돌릴 언어 모델은 4비트로 16GB대에 들어가는 27B가 현실적이고, Qwen-Image-2.1은 2026년 9월부터 비상업 연구 라이선스이며 Qwen3-TTS는 Apache 2.0으로 한국어 목소리 복제를 지원합니다.

참고 자료

Share

제대로 이해했는지 한 문제로 확인해 볼까요?

답을 고르면 바로 풀이가 나와요.

개인 컴퓨터에서 직접 돌릴 큐원 언어 모델을 고를 때 2026년 9월 기준으로 현실적인 선택은 무엇일까요?

10개념 / 클래스로컬 모델 크기 고르기, 8B와 27B와 70B가 뜻하는 것