NVIDIA
GPU 世代から計算資源の供給まで、NVIDIA の AI 動向をチップ・推論最適化・クラウド連携で追う。
GPU 世代から計算資源の供給まで、NVIDIA の AI 動向をチップ・推論最適化・クラウド連携で追う。
2026年8月21日、RadixArk SGLangチームとAnt Ling InfraチームはLMSYS公式ブログでLing-3.0-flashの単一リクエスト復号最適化結果を発表しました。 4台のNVIDIA Blackwell GPU、TP4、bf16、並行処理が1に設定された固定環境下では、...
Cursor は最近、 Blackwell GPU で MoE model のトークン生成パスを再構築し、このメソッドをwarp decodeと名付けたことを明らかにしました。公式には、この低レベルの最適化は推論スループットを1.84 倍に向上させ、出力をFP32の参照値に近づけます。関連する改善は...
Googleとの協力や業界の競争状況について、NVIDIAはGoogleの人工知能分野での進展を喜び、今後も関連するコンピューティングパワー製品やプラットフォームサポートを提供し続けることを強調しました。 NVIDIAは、自社プラットフォームが現在の生成AIの波の中で「リーディング世代」の地位にある...
OpenAIとNVIDIAは、OpenAIの次世代AIインフラストラクチャ向けに、数百万基のGPUを含む少なくとも10GWのNVIDIAシステムを導入するための戦略的提携を発表しました。これらのシステムは、後続モデルのトレーニングと実行に使用されます。NVIDIAはこれを支援するため、各段階で利用可...
1. ChatRTX とは何ですか ?簡単に言うと、ChatRTX は NVIDIA が立ち上げたネイティブの RAG チャット アプリケーション であり、 ドキュメント、メモ、写真、 その他のコンテンツのデータベースを構築し、大規模な言語モデルと連携して回答を取得および強化します。 TensorR...