- 2026/09/02 22:00 掲載
米Runwayがコード不要の対話型インターフェイス世界モデル「Solaris」を発表
画面のピクセル自体を直接合成するインターフェース世界モデル
この構造により、事前にプログラムされた動作の範囲を超え、物理世界の法則に基づいた自然な環境エミュレーションが可能となる。 Runwayが250名を対象に実施した比較テストでは、大規模言語モデルのClaude Opus 5を用いてコードで作成された画面に対し、Solarisが生成した画面は指示への追従性で61パーセント、挙動の自然さで71パーセントの支持を獲得した。事前に定義された状態遷移に縛られないため、衣服の質感や物体の物理的な連動性をシームレスに描き出すことができる。
応答遅延は500ミリ秒未満に抑えられ、解像度720pでのリアルタイム生成を実現している。自己回帰生成やステップ数の削減といった技術的な最適化により、従来の動画生成AIにあった生成時間の長さを克服した。 一方で商用ソフトウェアとして普及するための技術的課題も複数報告されている。確率的にピクセルを塗りつぶす動画拡散モデルの特性上、操作画面に不可欠な文字の描画が不安定になりやすい。また画面が純粋な動画ストリームのピクセルデータとして構成されるため、背後に論理的な構造を持たず、視覚障害者用のスクリーンリーダーなどの補助機能が情報を読み取れないというアクセシビリティの欠陥が存在する。
実際には存在しない誤った商品価格や数値データを表示してしまうハルシネーションのリスクや、長時間の操作に伴うレイアウトの崩れも技術的なハードルとなっている。 専門家の間では、この技術は特定の画面構造に依存しないため、AI自律エージェントが視覚的理解に基づく操作能力を獲得するための訓練環境として役立つと指摘されている。Solarisは現在研究プレビューの段階にあり、一般提供の時期や詳細な価格体系は公開されていない。Runwayは一部のパートナー企業とともに初期アクセスのテストを進めている。
AI・生成AIのおすすめコンテンツ
AI・生成AIの関連コンテンツ
PR
PR
PR