グーグルは攻勢に新たな一歩を踏み出した ビデオゲームに応用された人工知能と 仮想世界 数行のテキストプロンプトや画像に基づいてユーザーがインタラクティブな環境を生成・操作できるプロトタイプ「Project Genie」の発表に際し、同社はこのツールをまだテスト段階にある実験的なものとして発表しました。しかし、初期のデモンストレーションは業界内で興奮と懐疑の両方を引き起こしました。
現時点ではアクセスは 米国のGoogle AI Ultraプラン加入者短いセッションとパフォーマンスは、システムの実験的な性質を明確に示しています。それでも、このプロジェクトは、誰もが ほんの数秒で小さな「プレイ可能な世界」を作成するグラフィック エンジンのプログラミングや操作方法を知らなくても、
Project Genie とは何ですか? また、どのようなテクノロジーを組み合わせていますか?

プロジェクト・ジーニーは Google DeepMindとGoogle AIが開発した研究プロトタイプ インタラクティブな世界生成器として機能する。その技術的基盤は3つの柱から成り立っている。動的環境のシミュレーションに特化したGenie 3モデル、ビジュアル面とスケッチを担当するNano Banana Pro、そしてユーザーの指示を解釈し、作成中のアシスタントとして機能するマルチモーダルモデルGeminiである。
システムの核心は Genie 3は、画面上で何が起こるかをフレームごとに予測できる「世界」モデルです。静的な 3D シーンのみを生成する従来の技術とは異なり、このアプローチでは、DeepMind の社内実験によると、約 720p の解像度と数分間の視覚的一貫性で、環境がプレイヤーの動きにリアルタイムで反応できるようになります。
その基盤の上に統合されている ステージの初期イメージ生成を担当したNano Banana Pro 説明文や参照画像から始まるこの初期ビューは、グラフィック スタイル、世界の構成、探索中に操作するキャラクターの外観を決定するためのスケッチとして機能します。
最後に、 Geminiはオーケストレーション層とアシスタントとして機能します自然言語の指示を解釈し、世界を即座に調整するのに役立ち、視点(一人称または三人称)の変更、既に作成された環境のリミックス、複数のアイデアを 1 つのプレイ可能なシナリオに結合するなどのタスクを容易にします。
仮想世界がどのように作られ、探索されるか

プロジェクト・ジーニーの運営は、 3段階の進行プロセス Googleはこれを、スケッチ、探索、そして世界の融合と要約しています。目標は、誰もが追加のツールを必要とせずに、アイデアから小さなインタラクティブな体験を実現できるようにすることです。
最初の段階では、ユーザーは作成したい世界の説明文を書いたり、参考画像をアップロードしたりします。その入力から、 Nano Banana Proは静的プレビューを生成します 設定は、ローポリ風の森、未来的な都市環境、歴史的な風景など、テキストに記載されているものなら何でも構いません。キャラクタータイプ、カメラモード、基本的な動作パラメータもこの段階で定義されます。
スケッチが承認されると、Genie 3が登場し、プレイヤーは W、A、S、Dキーなどの一般的なPCコントロールを使用して、環境を自由に探索します。モデルは、キャラクターの前に現れるものを即座に生成し、前のフレームに基づいて各フレームを予測し、カメラが向きを変えたり、すでに訪れたエリアに戻ったりするときに一定の一貫性を維持します。
3つ目の重要な能力は 世界の組み合わせとリミックスこのシステムでは、ユーザーは以前に生成されたシナリオを再訪したり、新しいパラメータで修正したり、複数のシナリオを統合したり、Googleが事前に生成したワールドをベースにしてバリエーションを構築したりすることができます。さらに、セッションの動画は他のユーザーが視聴したり、インスピレーションを得るために共有することもできます。
これらはすべて、他のGoogle AIサービスと同様のウェブアプリケーションから実行されるため、 追加のプログラムをインストールする必要はなく、高度な技術的知識も必要ありません。ツールにアクセスし、指示を入力し、興味深い結果が見つかるまで組み合わせのテストを開始するだけです。
技術的な制限:時間、パフォーマンス、リアリズム

Googleは、Project Genieを次のように定義することを主張している。 顕著な実験的性格を持つ研究プロトタイプこのラベルは単なる形式的なものではありません。現在の経験では、当初の好奇心を超えてツールの実際の使用を条件付けるいくつかの明確な制限が存在します。
最も明白なのは 生成と探索セッションごとに60秒の制限その1分後、世界はシャットダウンし、新たな体験が始まります。同社は、この制限により、各セッションでプレイ中のユーザー専用のチップが確保されるため、コンピューティングリソースをより効率的に配分できると説明しています。
パフォーマンスの点では、公開テストでは 720pに近い解像度と1秒あたり20~24フレームの周波数これらの機能には、キャラクターの移動やカメラの切り替え時に顕著な入力遅延が伴います。一部の初期テスターによると、この体験は、完全にスムーズな従来のビデオゲームというより、インタラクティブな動画のような感覚だそうです。
また、Genie 3では これは従来のグラフィック エンジンではなく、次のフレームを予測するモデルです。 上記を踏まえると、結果として奇妙な動作が発生します。例えば、パスのテクスチャが何の理由もなく変化したり、要素が消えたり、物理法則が不自然だったり、アニメーションがランダムに変形したりします。
Google自身も、生成された世界は 「それらは完全に現実のように見えるとは限らず、また、常に兆候や物理法則に従うとは限りません。」キャラクター操作も不正確になることがあります。つまり、この技術は将来性を感じさせますが、ゲームプレイやビジュアルの安定性という点では、洗練されたゲーム体験を提供するにはまだまだ遠いと言えるでしょう。
アクセス制限と国際ロードマップ

この最初のフェーズでは、Project Genieは 米国のGoogle AI Ultra顧客同社の最も高度なサブスクリプションプランは、高性能なAI機能を必要とする企業やクリエイター向けに設計されています。これはプレミアムサービスであり、実験にアクセスできるユーザー数は制限されています。
検査を制限する決定は、 各セッションの計算コスト これは、Googleが広範な展開に先立ち、詳細なフィードバックを収集することに関心を持っているためです。DeepMindの研究ディレクターであるシュロミ・フルッチャー氏は、これらのツールをより多くの人々に公開し、実際の使用状況に関する意見を集めることができるのは「非常にエキサイティング」だと強調しましたが、現時点ではヨーロッパやその他の市場への導入時期は未定です。
スペインやヨーロッパのユーザーや研究の観点から見ると、少なくとも短期的には、 最も現実的な役割は観察者の役割であるテストを綿密に追跡し、ソーシャル メディアですでに流通しているビデオを分析し、このテクノロジをレベル デザイン、ラピッド プロトタイピング、アイデアの視覚化のワークフローにどの程度統合できるかを評価します。
Googleは、 アクセスを徐々に拡大する パフォーマンス、コスト、そして法的問題が許せばの話ですが、その拡大ペースはコミュニティの反応や、著作権やサードパーティコンテンツの責任ある利用をめぐる議論の進展にも左右されるでしょう。
有名なゲームを模倣する能力と著作権論争
プロジェクト・ジーニーの最も繊細な点の一つは、 既存のビデオゲームから明らかにインスピレーションを得た世界を、成功度の差はあれ再現する能力専門ジャーナリストの中には、『スーパーマリオ64』、『メトロイドプライム』、『ゼルダの伝説 ブレス オブ ザ ワイルド』などのタイトルに明らかに似たシナリオを作成することに成功した人もいます。
ゼルダの場合、それらは ジャンプするとパラグライダーを展開するキャラクターこのジェスチャーは任天堂のゲームと密接に関連しています。これらの偶然の一致は、このモデルが多数の公開ゲームプレイ動画を用いて学習されたことを示唆しており、AI学習における知的財産の取り扱いについて疑問が生じています。
非常に有名なフランチャイズからインスピレーションを得た世界を再現するいくつかのテストを経て、Googleは 特定のシナリオやキャラクターの生成をブロックする特に具体的な名前や商標が言及されている場合は、その傾向が顕著です。場合によっては、ツールが「サードパーティのコンテンツプロバイダーの利益」を理由に、特定のサーガに基づいた世界の作成を直接阻止することがあります。
同社は、プロジェクト・ジーニーは 「主に公開されているウェブデータでトレーニング」しかし、これらのコンテンツは著作権法の適用対象となることを忘れないでください。そのため、現在も構築中のモデレーションシステムでは、著作権で保護された作品を複製しようとする試みは明確にブロックされる一方で、過度に直接的な言及を避ければ、他の作品は問題なく通過します。
この不規則な行動は、次のような議論を巻き起こしている。 AI は既存のゲームからどの程度インスピレーションを受けることができるでしょうか、あるいは受けるべきか? では、オマージュ、模倣、コピーの境界線はどこにあるのでしょうか?この議論は、AIの学習データや著作権に関する規制枠組みがまだ確立されていない欧州連合のような地域で特に重要になるでしょう。
ビデオゲーム業界への潜在的な影響
視聴するメディアの魅力を超えて 「マリオのような」または「ゼルダのような」世界が数秒で生成されるProject Genieは、大手テクノロジー企業によるゲーム開発への生成AIの適用をめぐる広範な競争の一環を成すものです。例えば、マイクロソフトは設計・制作プロセスの一部を自動化するMuseなどのプロジェクトを発表しており、他の企業もコスト削減と開発加速を目指して同様のソリューションを模索しています。
この文脈において、Googleの提案は 迅速なプロトタイピングと実験ツール これは独立系スタジオと大手パブリッシャーの両方にとって興味深いものとなるでしょう。スケッチや数段落のテキストからプレイ可能なシナリオを構築できる機能により、アイデアの早期検証、社内デモの作成、メカニクスのテストを、数ヶ月もの作業を費やすことなく容易に行うことができます。
しかし、こうしたソリューションの台頭は、業界関係者の間で懸念を引き起こしている。一方で、 特定の専門職のプロフィールに及ぼす潜在的な影響について懸念があります。 コンテンツの一部が自動生成される場合。一方で、多くの開発者は、著者への明確な報酬なしに、既に出版されている作品でAIをトレーニングするビジネスモデルに警戒感を抱いています。
文化創作物の保護に関する議論が特に激しい欧州およびスペイン市場では、Project Genieのようなツールが将来の規制にどのように適合するかを見極めることが極めて重要になります。学習データに関する透明性、権利者向けのオプトアウトシステム、生成されたコンテンツの帰属表示といった側面は、慎重な導入と開発者やパブリッシャーとの継続的な対立の分かれ目となる可能性があります。
今のところ、プロジェクト・ジーニーはまだ初期段階にあり、 完成品というよりも、公共の実験室として機能します。その進化と、関連する法的および倫理的問題を Google がどのように処理するかによって、これが最終的にスタジオのワークフローに統合されるか、それとも派手だが限定的な実験のまま残るかが決まります。
しかし、このプロトタイプの外観は、大手テクノロジー企業が インタラクティブな世界の自動生成 第一級の戦略的な領域。現状では実際の使用は限定的で技術的な欠陥に悩まされているものの、進むべき方向は明確だ。テキストや画像をプレイ可能な体験へと変換できるモデルがますます増え、業界はこうした新しいツールとどのように共存していくかを決めなければならない。