GLM-5.3이 Amazon Bedrock에 정식 출시됐다. 2026년 10월 6일, 즈푸의 Z.ai는 자사 플래그십 모델이 AWS의 대규모 모델 플랫폼에 입점했다고 발표했으며, AWS 공식 문서에는 모델 출시일이 10월 5일로 표기되고 접근 권한은 자격을 갖춘 고객에게만 제공된다고 명시돼 있다. 같은 날 커촹반일보 보도에 따르면 AWS는 모델 호출량을 기준으로 즈푸와 수익을 나누기로 했다. 즉 즈푸의 해외 매출은 라이선스 판매가 아니라 API 호출이 일어날 때마다 발생하는 구조로 바뀌고 있다.
모델 자체: 총 744B 파라미터, 코딩 에이전트를 정조준
AWS 공식 모델 페이지에 따르면 GLM-5.3은 즈푸의 오픈 웨이트 플래그십 텍스트 모델로, MoE 아키텍처를 채택해 총 파라미터 744B, 토큰당 활성화는 약 40B 규모다. GLM-5.2와 같은 베이스를 사용하고 후훈련 규모를 키워 성능을 끌어올렸다. 컨텍스트는 100만 토큰, 최대 출력은 12.8만 토큰을 지원하며, 추론 강도를 단계별로 선택할 수 있어 호출 측이 지연 시간과 토큰 소비, 품질 사이에서 균형을 조절할 수 있다.
공식적으로 제시된 활용 사례를 보면 겨냥점은 분명하다. 에이전트형 코딩과 자율 소프트웨어 엔지니어링, 터미널 및 CLI 작업, 저장소 규모의 코드 생성과 리팩터링, 여러 도구 호출에 걸친 장기 엔지니어링 작업이다. 함수 호출, 구조화된 JSON 출력, 스트리밍(추론 과정 스트리밍 포함)도 지원한다. 잡담으로 승부하는 모델이 아니라 기업 개발 파이프라인에 들어가기 위한 모델이다.
진짜 뉴스는 수익 배분 방식이다
대형 클라우드에 모델이 입점하는 것 자체는 새롭지 않다. 새로운 것은 돈이 나뉘는 방식이다. 호출량 기준 수익 배분은 모델 개발사를 클라우드 진열대의 '공급자'로 바꾼다. 클라우드는 글로벌 리전, 규제 대응, 기업 고객 관계, 과금 체계를 제공하고, 모델사는 능력을 제공해 사용량에서 배분을 받는다. 보도에 따르면 즈푸는 최근 여러 해외 클라우드 사업자와 유사한 방식을 도입했고, 중국 내에서는 알리바바 클라우드 바이롄과 비슷한 배분 계약을 맺었으며 화웨이 클라우드에도 GLM-5.3이 올라가 협력이 추진되고 있다. 국내외를 잇는 배분 네트워크가 과거의 '한 곳씩 라이선스 협상' 방식을 대체하고 있다.
즈푸에게 이 방식의 장점은 가벼움이다. 나라마다 영업 조직을 두지 않아도 매출이 실제 사용량에 따라 커진다. 대가로 가격 결정권과 고객 관계는 클라우드 사업자가 쥐고, 배분 비율도 공개되지 않았다. AWS 입장에서는 경쟁력 있는 오픈 웨이트 플래그십을 진열대에 추가해 기업 고객이 경쟁 클라우드로 빠져나가는 것을 막을 수 있다.
사용 전 확인해야 할 두 가지 문턱
첫째는 자격 문턱이다. AWS는 GLM-5.3을 자격을 갖춘 고객에게만 제공하며 AWS 계정 팀에 문의하라고 안내한다. 가입만 하면 바로 호출할 수 있는 모델이 아니다. 둘째는 제공 방식이다. 이 모델은 리전 간 추론만 지원하며 미국 지리 추론 프로필(us.zai.glm-5.3)이나 글로벌 프로필(global.zai.glm-5.3)을 사용해야 하고, 리전 내 온디맨드 추론은 지원하지 않는다. 데이터 상주 요건이 엄격한 기업이라면 요청이 국경을 넘을 가능성을 사전에 평가해야 하며, 이는 '모델이 강한가'와는 별개의 문제다.
더 큰 그림에서 보면 중국 오픈 웨이트 모델은 '벤치마크에서 이기는' 단계에서 '글로벌 클라우드 진열대에서 돈을 버는' 단계로 이동하고 있다. 순위는 주목받을지를 결정하고, 배분 채널은 연구개발비를 회수할 수 있는지를 결정한다. 이 수의 성패는 출시 당일의 화제성이 아니라 앞으로 몇 분기 동안 Bedrock에서의 실제 호출량이 결정할 것이다.