Google Project Genie: Genie 3のローンチとユーザーフィードバックの分析
- Aisha Washington

- 6月6日
- 読了時間: 9分
更新日:6月17日

Googleは、生成AIをプレイ可能な環境に変換しようとする研究プロトタイプを正式にリリースしました。Google Project Genie新しいGenie 3基盤モデル上に構築されたものが、一部の加入者向けに利用可能になりました。その可能性は計り知れません。テキストプロンプトや画像を無限のインタラクティブな世界に変換することです。
しかし、現実は印象的なテクノロジーとフラストレーションのたまる使いやすさのミックスです。早期導入者は、画像生成は堅実である一方で、「ゲームプレイ」体験は入力遅延や短いセッション制限といった根本的な問題に苦労していることに気づいています。これは従来のゲームエンジンではなく、次に何が起こるかを推測しようとするビデオ予測モデルです。
ユーザーエクスペリエンス:Google Project Genieの実際
最も重要な情報が含まれているため、ユーザーエクスペリエンスから始めます。Google AI Ultraにサインアップしてこれを試そうとしているなら、実際にプレイするのがどのようなものかを知る必要があります。
早期テスターからの一般的な意見は次のとおりです。Google Project GenieGoogle Project Genie は、ビデオゲームというよりは夢のシミュレーターのように機能します。ビジュアルは変化し、物理法則は破られ、操作感は切り離されたように感じられます。
Google Project Genie におけるパフォーマンスの問題:入力遅延とレイテンシ
「Google Project Genie」に関する最も一貫した苦情は、入力遅延です。ソーシャルプラットフォーム上の複数のユーザーは、標準的なゲームの応答性を期待している場合、その体験は「プレイ不可能」だと描写しています。
システムは、解像度 720p で約 24 フレーム/秒 (fps) で実行されます。現代のゲームの基準では、24fps はすでに低いですが、モデルの性質によって問題はさらに悪化します。ジャンプするためのボタンを押しても、AI は「player.y += 10」というコードを実行しているわけではありません。代わりに、ボタンの押し込みをトークンとして受け取り、前のフレームを見て、ジャンプがどのように見えるかを予測する「新しい画像」を生成しています。
このプロセスには膨大な計算能力が必要です。その結果、キーを押してから画面にアクションが表示されるまでに遅延が発生します。ユーザーは、クラウドゲーミングと比較して、ここの遅延が著しく大きいと不評を述べています。時には、操作が完全に失敗し、プレイヤーはキャラクターを操作する代わりにカメラのパンを見ているだけになります。
オブジェクトの永続性と視覚的一貫性の課題
のもう一つのハードルは、Google Project Genieの一貫性です。標準的なゲームエンジンでは、壁は衝突データを持つソリッドオブジェクトです。Genie 3では、壁はAIが壁のように見えると考えているピクセルの集まりにすぎません。
フィードバックによると、LLMでよくある問題である「幻覚」もここでは一般的です。
消えるトラック: レースや転がるシナリオ(「ローラーボール」デモなど)では、タイヤの跡やペイントの跡が作成されてから数秒で消えます。
環境の変形: モデルが「道路」という概念の文脈を失ったため、レーストラックが説明もなく草地になることがあります。
物理的なグリッチ:水が飛び散らず、キャラクターが床をすり抜けます。
AIがリアルタイムで物理演算を夢見ているため、地に足のついた体験ではなく、シュールで断片的な体験につながっています。
テクノロジーを理解する:Google Project Genieがゲームエンジンではない理由

ラグが存在する理由を理解するには、アーキテクチャを見る必要があります。Google Project Genieはビデオ予測モデルです。これはGoogle DeepMindが強調している重要な区別ですが、マーケティングの誇大広告で失われる可能性があります。
Genie 3はビデオ予測モデルをどのように使用するか
従来のゲームはポリゴン、テクスチャ、論理スクリプトを使用します。Google Project Genieはピクセルと確率を使用します。Genie 3モデルは、インターネット上の膨大な動画データセットでトレーニングされました。何百万時間もの映像を視聴することで、物事の動き方を学習しました。
システムと対話する際、3D空間内のキャラクターを動かしているわけではありません。基本的にAIに「右を押しています」というプロンプトを与えており、AIは似たような動画で「右」を押した場合に何が起こるかの確率に基づいて、動画の次のフレームを生成しています。
これが、ユーザーが気づいた特定のビジュアルスタイルを説明しています。このモデルは、Super MarioやMetroidのようなゲームのstyleを正確に再現できます。なぜなら、それらのゲームの映像を「視聴」した可能性が高いためです。ルールを理解していなくても、美的感覚を完璧に捉えています。
レンダリングと予測の違い
この技術的なアプローチこそが、Google Project Genieが「ゲーム」として苦戦する理由です。ゲームの状態が欠けています。
レンダリング(ゲーム): GPUによって計算されます。正確で高速です。
予測(Genie): TPU/GPUによってピクセルを推論して計算されます。計算負荷が高く、確率的です。
Google Project Genie がスムーズに機能するには、人間の目が遅延に気づくよりも速くフレームを予測する必要があります。現在、コンシューマーグレードのリアルタイムインタラクションには技術が追いついていないため、24fpsの制限と入力遅延が発生しています。
Google Project Genieの機能と制限
コアパフォーマンスを超えて、現在のプロトタイプには構造的な制限が組み込まれています。これらは、サーバーコストと安全性を管理するための厳格なガードレールである可能性が高いです。
60秒の時間制限
おそらく最も制限的な機能は、厳しい時間制限です。 remio のすべての Google Project Genie セッションは60秒に制限されています。
タイマーがゼロになると、セッションは終了します。進捗を保存することはできず、1時間世界を探索することも、長期的な物語を構築することもできません。これは、プロジェクトの「テクニカルデモ」としてのステータスを強化しています。
この制限には、おそらく2つの理由があります:
コンテキストウィンドウのドリフト: として、AIはより多くのフレームを生成しますが、元のプロンプトや開始画像を忘れてしまう可能性が高くなります。60秒の制限は、世界が完全な視覚的ノイズに劣化するのを防ぎます。
計算コスト:リアルタイムで24fpsの動画を生成するのは非常にコストがかかります。Googleはユーザーあたりのリソースを制限しています。
ワールドスケッチングと著作権のガードレール
「ワールドスケッチング」機能は、Google Project Genieが輝く場所です。ユーザーはプロンプトを入力するか、画像をアップロードしてワールドを定義できます。システムは以下をサポートします:
一人称および三人称の視点。
スタイル転送(例:「クレイメーションスタイル」、「レトロ8ビット」)。
統合ツール:以下のようなモデルを使用します。Nano Banana Proゲーム開始前に初期画像を洗練させる。
しかし、ユーザーからは、厳格ではあるものの一貫性のない著作権フィルターが指摘されています。「マリオ」を生成しようとすると、サードパーティの権利を理由にシステムがブロックする可能性があります。しかし、一般的なプロンプトでも、任天堂の有名キャラクターに法的に類似しているが視覚的には同一のキャラクターが生成されることがよくあります。
アクセスと要件: Google AI Ultra

Googleはまだ一般公開していません。これは、愛好家や開発者向けの実験として位置づけられています。
Google Project Genieを今すぐ試せるのは誰か?
アクセスは、Google AI Ultraサブスクリプションを通じて提供されます。さらに、米国に居住し、18歳以上である必要があります。
アクセスできるユーザーには、これをゲーム機ではなくクリエイティブツールとして扱うことをお勧めします。「World Remixing」機能を使用してビジュアルスタイルを反復処理します。Googleは、「Jump In」ボタンを押す前に「プレビュー」するために画像洗練ツールを使用することを推奨しており、生成がうまくいかなかった場合の失望を軽減します。
Outlook
Google Project Genieは、静止画からインタラクティブな動画への移行という点で、生成AIにおける重要な一歩を表しています。しかし、現在のバージョンは、その限界によって定義されています。入力遅延、60秒という制限、オブジェクトの永続性の欠如は、実際のゲーム開発ツールの代替としては不十分です。
Googleはこれを、Unreal Engineの競合製品としてではなく、機械に世界モデルと物理学を理解させるための汎用人工知能(AGI)への道と見なしています。今のところ、AIが将来どのようにエンターテイメントを生成する可能性があるかについての、魅力的ではあるものの不格好な窓であり続けています。
FAQ: Project Genieに関するよくある質問

1. Google Project Genieはプレイ可能なゲームエンジンですか?
いいえ、これは動画予測モデルです。ゲームコードや物理エンジンを使用せず、入力に基づいて次のピクセルフレームを予測することで、真のゲームではなくインタラクティブな動画を作成します。
2. Google Project Genieでなぜこれほど遅延が発生するのですか?
遅延は、AIが高解像度の画像をリアルタイムで生成する必要があるため発生します。 remio のあらゆる動きに対して。これは膨大な計算能力を必要とし、従来のクラウドゲーミングと比較してレイテンシが高くなります。
3. Google Project Genie でフルゲームを作成できますか?
現時点ではできません。システムにはセッションごとに厳密な 60 秒の制限があります。進行状況を保存したり、スコアを維持したり、1 分を超える複雑なレベルを作成したりすることはできません。
4. Google Project Genie にアクセスするにはどうすればよいですか?
remio が必要です。Google AI Ultraサブスクリプションをご利用で、米国にお住まいであること。これは、実験的なプロトタイプとして Google Labs 経由で利用できます。
5. Google Project Genie はマルチプレイヤーをサポートしていますか?
いいえ。現在の Genie 3 このモデルはシングルプレイヤー体験を生成します。ワールドは、その瞬間のユーザーの入力に基づいて特別に生成され、現時点では複数のユーザー間で同期することはできません。
6. マリオのような著作権で保護されたキャラクターを生成できますか?
システムには著作権侵害を防ぐためのガードレールが組み込まれています。有名なゲームに似たスタイルを生成することはできますが、保護されたキャラクターの直接的なリクエストは通常ブロックされます。
7. 生成されるワールドの解像度とフレームレートはどのくらいですか?
現在のプロトタイプは、約720pの解像度と毎秒24フレームで動作します。


