ToolNavs 便利なAIツールを発見
ツール投稿 ログイン
戻るAI情報
DeepSeek V4 Flash Visionが重みを開ける:マルチモーダルエージェントがオンプレミス展開へと移行

DeepSeek V4 Flash Visionが重みを開ける:マルチモーダルエージェントがオンプレミス展開へと移行

AI情報 Admin 2 回閲覧

2026年8月31日、DeepSeekは公式組織のHugging Face deepseek-aiでDeepSeek-V4-Flash-Vision-Expオープンウェイトを開始しました。モデルリポジトリは同日06:16(UTC)にMITライセンスを用いて作成され、モデルファイル、トークナイザー、プロンプトエンコーディング参照、最小化されたPyTorch推論実装を提供しています。これは8月21日のAPIローンチ発表の繰り返しではありません。以前はクラウドベースの呼び出し可能性が扱われていましたが、今回は重みとキーリファレンスコードが開発者に引き継がれています。

「図インターフェース」から検査可能なモデル資産へ

公式モデルカードは約3050億のパラメータを持ち、純粋なテキストエージェントタスクとしてDeepSeek-V4-Flash-0731に近いレベルを維持しつつ、視覚的理解も組み込んでいることを示している。画像、チャート、ソフトウェアインターフェース、テキストコマンドを同じタスクチェーンに配置でき、ウェブ操作、チャート解析、スクリーンショットのトラブルシューティング、視覚的な品質チェックに適しています。API機能の前段階を理解するには、DeepSeek-V4-Flash-Vision-Expのローンチ解釈を参照できます。

DeepSeekの自己テストでは、ApexBench Pass@1テキスト版の26.2から36.5に向上し、Chartographyで64.3、ZeroBench Pass@5で35.0を獲得しました。また、Terminal Bench 2.1で83.9、DeepSWEで59.3を獲得しました。しかし、これらの数値は公式モデルカードからのものであり、すべての実際の業務の安定性と直接同一視することはできません。

オープンウェイトは、箱から出したまま普通のパソコンを使うのとは違います

チームにとっての価値は、プライベートスクリーンショットや内部インターフェースを中心に監査可能で微調整され、制御されたエージェントを構築することにあります。ただし、導入の閾値は依然として高いままです。3,050億のパラメータがあるため、ウェイトストレージ、VRAM、推論フレームワーク、マルチカード通信は消費者向けコンピュータでは簡単に処理できず、倉庫内の最小推論コードも既製品の製品ではありません。

したがって、この開拓はマルチモーダルエージェントの研究基盤をクラウドベンダー、推論フレームワークチーム、コンピューティングパワー企業に引き渡すようなものです。短期的には、小規模および中規模の開発者がまずAPI検証タスクを使い、その後に量子化、管理推論、プライベートクラスタのいずれを使うかを判断するのに適しています。本当に注目すべきは「モデルのダウンロード可能性」ではなく、閉鎖インターフェースから検査可能かつ遷移可能なエンジニアリング資産への視覚エージェントの移行です。

おすすめツール

もっと見る