2026年8月25日、AppleはプレスリリースでM6およびM5 Ultraを発表し、単に新世代へのチップ切り替えだけでなく、メモリ容量、帯域幅、ニューラルネットワークコンピューティングの組み合わせにローカルAI競争を取り戻すことに注力しました。 M6は新世代のMacをターゲットにしており、M5 Ultraはデスクトップワークステーションレベルにより大きく統一されたメモリを提供します。
この2つのチップはどんな問題を解決しているのでしょうか?
M6はAppleが初の2nmプロセスと主張し、12コアCPU、12コアGPU、デュアル16コアニューラルエンジンを搭載し、最大170GB/sの統一メモリ帯域幅と最大32GBのユニファイドメモリをサポートしています。 Appleは、デュアルニューラルエンジンのピーク計算能力は前世代の最大2倍に達し、GPUのAI計算能力はM5より約30%高いと主張しています。
M5ウルトラは初めてクアッドチップインターコネクト設計を採用し、最大36コアCPU、80コアGPU、1.2TB/sの統一メモリ帯域幅、512GBの統一メモリを提供します。 Appleは、この容量と帯域幅の組み合わせにより、より大きな言語モデルがデバイス上で直接動作し、リモートサーバーへの依存を減らすことができると述べています。
ローカルAIにおける統一メモリの真の価値
モデルの重み、コンテキスト、 KVキャッシュ はすべてメモリを占有します。 容量が不足している場合、システムはモデルを縮小したり、コンテキストを縮小したり、作業をクラウドに戻すしかできません。 統合メモリにより、CPU、GPU、ニューラルエンジンが同じデータプールを共有し、輸送コストを削減します。
しかし「512GB」だからといって、どんな大型モデルでもスムーズに動作できるわけではありません。 量子化手法、推論フレームワーク、演算子適応、コンテキスト長、スケジューリングはすべて体験を変えます。 開発者はまた、MetalやCore MLのようなネイティブパスを適応させ、消費電力や並行処理も必要です。
このアップグレードには明確な境界線があります
Apple Intelligence関連の機能はまだテスト段階にあり、macOS 27のリリース日、言語地域対応、モデルによって異なります。 大型モデルは貯蔵圧と冷却圧も備え、 短いテキストのみを扱うユーザーにとっては、M5 Ultraの追加メモリが大きな効果に結びつかないかもしれません。
したがって、M6はMacのネイティブAIの基盤を前進させ、M5 Ultraは大規模モデル、ローカルデータ、長いコンテキストを必要とするユーザーをターゲットにしています。 サードパーティフレームワークがいつ適応されるのか、またアプリケーションがプライバシー、低遅延、オフライン機能を提供できるかどうかは注目に値します。