アリババクラウドはModel Studio内でWan2.6-Image(wan2.6-image)を呼び出す機能を更新し、「本番対応」の画像生成および編集モデルとして位置づけました。 公式情報によると、このモデルは画像やテキストの段階的な出力をサポートし、テキストと複数の画像を含むコンテンツを1回のリクエストで生成できるため、ステップバイステップのチュートリアルやストーリーボードなどの物語的な視覚表現に利用できます。
生成および編集レベルでは、WAN 2.6-imageは生成に参加する1〜3枚の参照画像をサポートし、スタイル参照、背景置換、要素融合などの複数画像条件の作成を実現し、繰り返し描画を減らす画像編集機能も提供します。 インターフェース側は非同期タスクモードで結果を返し、出力形式はPNGで、「AI生成」ウォーターマークはオンデマンドでオンデマンドで設定可能です。 テキストプロンプトは中国語と英語の両方で利用可能で、長さにも制限があります。 商業利用は引き続き素材のライセンス、ポートレート、ブランド要素の遵守に注意を払い、無許可の参照画像を直接商業利用に使用しない必要があります。
よくある質問
Q: Wan2.6画像と通常の文生図の違いは何ですか?
A: 文生図に加え、画像編集、グラフィックやテキストの段階的な出力、複数の参照画像との融合・置換もサポートしています。
Q: Wan2.6-Imageは複数の参照画像のスタイルと背景を組み合わせられますか?
A: はい、インターフェースの例では複数の画像を同時に入力することをサポートしており、モデルがスタイルや背景などの要素を指示に従って借用できます。
Q: Wan2.6-Imageの画像およびテキスト出力はどのようなコンテンツに適していますか?
A: テキストと画像を交互に挿入する必要がある「ステップバイステップチュートリアル」、「ストーリーボード」、「説明付きポスタードラフト」などに適しています。
Q: Wan2.6-Imageは商用整合性要件をサポートしていますか?
A: 公式の宣伝では、商業シナリオにおいてより安定したスタイルと主題の一貫性を強調していますが、具体的な効果は依然として自社の資料やプロセスで検証・検証が必要です。