P-04課題解決

World Modelは具体的にどのようにAIエージェントの訓練に活用されていますか?

Google DeepMind公式ブログ(deepmind.google)が2025年8月5日に発表した内容によると、同社のWorld ModelシステムGenie 3は、テキストプロンプトからリアルタイムに操作可能な対話型環境を24フレーム毎秒・720p解像度で生成し、数分間の一貫性を保つことができます。DeepMindはこのGenie 3が生成した環境内で、自社のエージェント「SIMA」に特定の目標を追わせる実験を行い、「より複雑な目標を達成するために、より長い一連の行動を実行することが可能になった」と報告しています。同ブログはこの技術がAIエージェントやロボットをシミュレーション環境で大規模に訓練するための基盤になると位置づけ、汎用人工知能(AGI)に向けた重要な一歩と表現しています。ただし現状の制約として、継続的な対話は「数時間ではなく数分程度」にとどまるとも明記されています。

実績・根拠

情報ソース