2026년 8월 3일, Qwen 팀은 공식 Qwen 블로그를 통해 Qwen 3.8-Max를 공개하며 현재 제품군 중 가장 강력한 모델로 자리매김했습니다. 이 모델은 이미 QwenCloud를 통해 접근 가능하지만, 공식 계획은 다음 주 Hugging Face와 ModelScope에서 오픈 웨이트를 공개하는 것이기 때문에, 아직 '웨이트 다운로드 가능'으로 표기할 수 없습니다.
규모가 커질수록 컴퓨팅이 완전히 활성화되지는 않습니다
Qwen3.8-Max는 Qwen3.5의 아키텍처 기반을 이어가며, 한 추론당 2.4조 개의 매개변수와 950억 개의 매개변수가 활성화됩니다. 이 모델은 더 큰 지식과 역량을 유지하며, 일부 전문가만 계산에 참여하도록 일정을 정합니다. 사이트의 혼합 전문가 모델 설명을 참고해 주세요. 하지만 950억 개의 활성화 매개변수는 여전히 상당한 추론 부담을 의미한다; 메모리 요구사항, 양자화 방식, 라이선스 조건, 로컬 배포 비용은 판결 전에 동등한 가중치와 모델 카드로 공개적으로 인정되어야 합니다.
코드 답변에서 프로젝트 완성으로 초점이 옮겨갔습니다
공식적인 중점은 코딩, 실제 작업, 연구, 장기 작업, 그리고 멀티모달 에이전트에 주요 업그레이드 방향으로 있습니다. 이 시연에는 10일이 넘는 기간 동안 엔지니어링 프로젝트를 직접 제작하고 자체 반복했으며, 약 125시간에 걸친 종이 복제 및 개선 작업이 포함되었습니다. 후자는 약 7,600줄의 코드를 작성했고, 1,100건 이상의 연산을 수행했으며, 33차례의 GPU 훈련을 받았습니다. 초기 Qwen 3.6-Max-Preview와 비교하면, 단일 실행 프로그래밍 기능에서 다일간 자율 실행 및 피드백 루프에 초점이 옮겨졌습니다.
리더보드 결과는 테스트 조건으로 반환되어야 합니다
Qwen이 발표한 결과에 따르면 Qwen 3.8-Max는 PaperBench, OSWorld-Verified, WideSearch 같은 프로젝트에서 우수한 성능을 보이지만, 표에는 공개 및 내부 벤치마크가 모두 포함되어 있으며, 모델마다 프록시 프레임워크, 컨텍스트 길이, 런타임 제한이 다를 수 있습니다. 이 수치들은 능력 방향을 판단하는 데 적합하며, 통합된 환경에서 절대적인 순위로 받아들여서는 안 됩니다. 더 가치 있는 검증은 오픈 가중치 후 제3자 재테스트와 실제 코드베이스에서의 성공률, 복구 능력, 단위 작업 비용에서 나올 것입니다.
개발자들이 지금 할 수 있는 일들
QwenCloud는 OpenAI 사양과 호환되는 Chat Complexations, Responses 인터페이스, 그리고 Anthropic과 호환되는 인터페이스를 지원합니다. 이 모델은 xhigh, medium, low의 세 가지 reasoning_effort 수준을 제공하며, 기본적으로 xhigh를 사용하고 사고 상태는 기본값으로 유지됩니다. 이 단계에서는 고정 작업 집합을 사용하여 지연 시간, 가격, 도구 호출 안정성, 긴 작업 중단 복구를 테스트하는 것이 적합합니다; 민영화 배포나 2차 교육이 필요한 팀은 다음 주까지 기다려 무게 문서, 면허, 하드웨어 요구 사항을 확인해야 합니다. Qwen 3.8-Max의 진짜 분수령은 2.4조 수치 자체가 아니라, 오픈 버전이 클라우드 시연에서 장기 신뢰성을 재현 가능한 환경으로 가져올 수 있느냐에 있습니다.