Zhipu(Z.ai)は GLM-5.3-Flash(320B-A18B)を正式に発売し、オープンソース化しました。 GLM-5シリーズ初のネイティブマルチモーダルモデルであり、1Mトークンコンテキストをサポートし、API価格をフラッグシップモデルのごく一部にまで引き下げています。 単に大きなスペックを追求するのではなく、このリリースはむしろ「能力とコストの比率」を競う攻撃のように感じられます。
320Bパラメータ、18Bのみが起動
GLM-5.3-Flashの総パラメータ数は320Bで、推論ごとに18Bのみが有効化されるため、計算負荷を削減しつつフロンティアモデルの機能を維持しています。 ネイティブのマルチモーダルおよび1Mコンテキストにより、コード、画像、長いタスクが同じエージェントワークフローに入ることが可能です。
人工分析知能指数では、このモデルは57点を獲得し、Claude Opus 4.8と同じランクにランクインしました。 Zhipuが自ら開発した Z.ai Code Benchも同様のプログラミング性能を提供しますが、後者はベンダーのテスト標準に基づいています。
オックス・アルファが正体を明かす
公式リリース前には、OpenCodeおよびOpenRouterで Ox Alpha という名前で匿名でプレビューされていました。 Zhipuは、このトラフィックは完全に中国のAIチップによって駆動されていると主張しています。 現在、モデルの重みはMITライセンスの下で公開されており、開発者自身が展開できるようになりました。
匿名のストレステストからオープンウェイトに至るまで、このアプローチは家庭用計算能力の検証シナリオをモデルトレーニングを超えて大規模なオンライン推論へと拡張しました。
価格はスペックよりも攻撃的です
公式APIは2週間50%オフで、100万トークンあたり入力$0.075、出力$0.25、キャッシュ入力$0.015です。 この割引はサードパーティのモデルアグリゲーターもカバーし、AIプログラミングや高周波エージェント通話のコストを直接削減します。
Zhipaの基準によると、GLM-5.3-Flashは通常GLM-5.3の約10分の1の価格で、プロモーション期間は約20分の1、全体の価格はClaude Opus 4.8の140/5程度まで低く抑えられることもあります。 現在、このモデルはZCode、Coding Plan、Chat、APIに参入しています。
GLM-5.3-Flashのハイライトは単なる「Flash」だけでなく、最先端の機能、1Mのコンテキスト、オープンソースの重み付け、低コストAPIがすべて一つのモデルに統合されている点にあります。 このコスト構造が維持されれば、モデル競争は「誰が強いか」から「誰が強力な能力を拡大できるか」へとより速く移行するでしょう。