2026年8月31日、Runwayは公式リサーチページでSolarisを公開し、新世代の「インターフェースワールドモデル」シリーズの最初のモデルと称しました。このモデルは、従来のソフトウェアのデザインドラフトからコード実装への移行を回避し、アプリケーションやウェブサイトのビジュアルインターフェースをフレームごとに直接生成し、クリック、ドラッグ&ドロップ、自然言語コマンドで視覚が継続的に変化できるようにしています。
これはUI画像のアニメーションではありません。Solarisの目標は、画面全体を表示と相互作用の両方にすることです。ユーザーが家具をドラッグするとシーンが継続的に並べ替えられます。マテリアルが変更されると、その後のフレームはオブジェクトの関係を保持し、応答を続けます。Runwayは、この動的な環境をコンピュータがエージェントを操作する訓練にも活用できると考えています。これにより、固定されたウェブページのボタン位置だけを記憶するのではなくなりました。
推論とレンダリングは二つの層に分かれています
SolarisのRunwayに基づくGen-4.5ビデオ生成モデルの適応もGWM-1の世界モデルのアプローチを継続しています。システム内では、言語モデルがユーザーの意図を理解し、シーンがローカルで変化しているか全体的に変化しているかを判断し、次のアクションを提供します。ワールドモデルは意思決定をリアルタイムで連続した画像としてレンダリングします。クリックやドラッグといった動作はテキストや画像のプロンプトのように動作し、次のフレームの条件となります。
動画拡散を「セグメント生成に数秒から数分」からインタラクティブな速度に短縮するために、Runwayは自己回帰型フレーム単位生成を採用し、複数のノイズ除去ステップを数ステップにまとめ、高速モデルを自身の出力で学習させて長期的な視覚的安定性を維持しています。現在の公式目標には、リアルタイム応答、セッション中の一貫性、720pの映像品質が含まれます。このアプローチと通常の動画生成の違いを理解するには、「なぜワールドモデルはAIエージェントの鍵となるのか」という記事(/article/1301-world-model-why-its-considered-the-next-key-capability-for-ai-agents-and-bots)をご覧ください。
公式レビューは利点を強調しつつも、疑問点も残しています
Runwayは250名の参加者と30のインタラクションサンプルを招待し、約7,500件のペア判定を収集しました。Claude Opus 5で生成されたコードインターフェースと比較して、Solarisは「インタラクション指示に従うかどうか」で61%の好好評価を受け、コードスキームは24%でした。「行動が自然なものかどうか」ではSolarisが71%、コードスキームが21%のスコアを獲得しました。これはRunway自身が設計・発表したレビューで、視覚的な連続性の可能性を示しつつも、ソフトウェアの信頼性、パフォーマンス、または本番環境での保守コストと直接同一視するものではありません。
現時点では、コードの代替というよりはインタラクティブなプロトタイプのようなものです
Solarisには依然として4つの明確な境界線があります。動画生成で最も安定化が難しいテキストは、最も頼りにされているインターフェースです。誤ったがリアルな教育や商業的なビジュアルは信頼リスクをもたらします。長い会話の中でオブジェクト、意味論、状態が徐々に離れていく可能性があります。生成型インターフェースはスクリーンリーダー、アクセシビリティAPI、既存のソフトウェアシステムを統合する必要があります。フレームごとの生成コストは、既製品ウェブページを提供するよりも依然として高いです。
したがって、Solarisは現在、支払い、アカウント設定、正確なフォームのような高度に決定的なプロセスを直接扱うよりも、没入型製品展示、可変の教育デモンストレーション、概念実証、エージェント研修環境により適しています。Runwayは現在、パートナーと協力して公開リリースを促進しており、ページは早期アクセスアプリケーションのみに開放されています。本当に注目に値するのは「コードが消えるかどうか」ではなく、視覚生成がテキストの正確性、状態トレーサビリティ、アクセシビリティサポートという最低限の壁を突破できるかどうかです。