Google Deepmind の Gemini Robotics 2 は、卓上ロボットから全身ヒューマノイドまであらゆるものを制御するために構築された、これまでで最も先進的な視覚-言語-行動モデルです。 Gemini Robotics ER 2 は、より高度な推論層を追加します。
コンピューティングの供給、エネルギー、データセンターの容量によって、AI をいかに安価に実行できるかが決まります。インフラストラクチャの変化は数週間後に推論コストに現れます。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。