オープンな半分と、クローズドな半分
Intrinsic Coreは、グーグルが進めるフィジカルAIの取り組みの一部にすぎない。
Google DeepMindは米国時間7月30日、Gemini Robotics 2を公開した。三つのモデルからなり、それぞれ人型ロボットの全身の制御、ロボットが周囲の物理的な状況を理解して作業の段取りを組み立てる推論(embodied reasoning)、ロボット本体の上での実行(オンデバイス実行)を担う。発表時のパートナーには、米Apptronik(アプトロニック)、米ボストン・ダイナミクス、独Agile Robots(アジャイル・ロボッツ)、独Franka(フランカ)といった有力なロボットメーカーが名を連ねた。
ただし、利用できる範囲はかなり限られている。推論モデルのGemini Robotics ER 2はGoogle AI Studioで利用でき、それとは別にGemini Enterprise Agent Platformでもプライベート プレビュー版(一部の顧客に限った先行提供)として提供されている。一方、カメラの映像と言葉による指示をロボットの動きに変換する視覚・言語・行動(VLA)モデルと、そのオンデバイス版は、申請を経た早期アクセス パートナーにしか提供されていない。Gemini Robotics SDK(ロボット向けのソフトウェア開発キット)を使うには、限定テスター向けのプログラム(Trusted Tester Program)に参加する必要がある。
グーグルの立場に立てば、これはすべて理にかなっている。
ドライバーや運動学の計算ソフトは、作るのに費用がかかるわりに、他社に対する優位として守り抜くことはできない。同じものをもう一つ作っても、誰にとっても大した価値は生まれない。グーグルにとってはなおさらだ。一方、大量のデータで事前に学習し、さまざまな用途に応用できる大規模なAIモデルである基盤モデルは、非常に大きな価値を持ちうる。だからグーグルは、前者を開放し、後者の利用には制限を設けたのである。
狙いは、Intrinsic Coreを搭載したロボットの一台一台を、あとからGeminiのモデルを差し込めるソケットにすることなのかもしれない。ただし、問題が一つある。開放した半分(Intrinsic Core)と、利用を制限した半分(Geminiのロボット向けモデル)は、目に見える形ではまだつながっていないのだ。
DeepMindによるGemini Robotics 2の発表には、IntrinsicにもROSにも言及がない。Gemini Robotics SDKも、そのどちらにも触れていない。2月の発表では、IntrinsicがGeminiのモデルを利用し、DeepMindと緊密に連携するとされていた。今回のIntrinsicのプレスリリースも、Intrinsic Coreで作ったソリューションは同社のエンタープライズサービスと自動的に連携すると述べ、そのサービスには「高度なAIモデル」が含まれるとしている。
しかし、両者をつなぐ接点が実際にどのような形になるのかは、今のところはっきりしない。
それは、両者が狙っているロボットの種類が違うからかもしれない。Gemini Robotics 2が対象にしているのは、人型ロボットと、2本の腕を使った器用な作業である。これに対し、Intrinsic Coreが対象にしているのは、CNC工作機械への材料の投入を担う産業用のロボットアームで、ファナックやユニバーサルロボットの機種に対応している。両者が交わる点はあるのだろうか。
グーグルに尋ねてみたものの、答えを聞いてもよく分からないままだ。
「Intrinsic Coreは、自社の技術をより多くの人が利用できるようにし、フィジカルAIの開発者エコシステムの成長を加速させるという、Intrinsicのより広範な取り組みの一環であです(中略)Intrinsic Coreを使えば、開発者は当社のプラットフォームでの開発を、オープンな形で、しかも手元の環境で始められます」と、グーグルの担当者は述べた。


