先週、スタンフォード大学のエビ揚げロボットが爆発事故を起こした後、コーヒーを作るロボットが再び人気を集めている。 非常に強力なのは、人間のデモンストレーションビデオを視聴するだけで、わずか 10 時間のエンドツーエンドのトレーニングで、このタスクを完全に自立して学習し、完了できることです。 もちろん、より正確に言うと、コーヒーマシンを操作することです。 蓋を開けてコーヒーバッグを入れ、スタートボタンを押すだけです。リモコンを使わずに、すべての工程を一気に完了できます。 すぐに、一杯のコーヒーを持ち帰って楽しむことができるようになります。 なお、上記デモ動画には加速処理は一切施しておりません。これは、ロボットが現在達成できる実際の動作速度です。 これらに加えて、自律的なエラー訂正機能も備えています。 コーヒーバッグが正しく配置されていない場合は、人間が注意しなくても自動的に調整できます。 これに対して、元 Google DeepMind 研究者(ロボットの開発者でもある)が投稿を直接転送して「いいね」し、次のように繰り返した。
同社の創設者ブレット・アドコック氏は、これをロボット工学における ChatGPT の瞬間と呼んでいます。 この発言に全員が同意するかどうかは別として、ネットユーザーがそのトレーニング速度に感銘を受けていることは間違いない。
それで、このロボットは一体何なのでしょうか? コーヒーを作るための徹底的なトレーニング10時間上の写真のロボットは、Figure という商業会社が作ったものです。 Figureは米国に本社を置き、2022年に設立された汎用ヒューマノイドロボットを専門とする企業です。 創業者のブレット・アドコックはフロリダ大学を卒業し、26歳のときにオンライン人材市場ウェブサイトを設立しました。このウェブサイトは後に同業他社に1億1000万ドルで買収されました。その後、全電動垂直離着陸機を製造する航空宇宙会社を設立し、27億ドルで株式市場に上場しました。 現在、このロボット企業 Figure は多額の利益を上げています。同社は昨年 5 月にシリーズ A 資金調達で 7,000 万ドルを獲得し、その 2 か月後には Intel から 900 万ドルの投資を受けました。 フィギュア社は設立から約1年後の昨年10月、コードネーム「フィギュア01」という初のヒューマノイドロボットをリリースした。 歩き方は次のようになります: 今日見るコーヒーの淹れ方のデモンストレーションはこれで行われます。 このスキルを習得するのにたった 10 時間のトレーニングしかかかりませんでした。 図 01 は、エンドツーエンドのニューラル ネットワークを使用しています。人間がコーヒーを作るビデオを受信し、動作の軌跡を出力することで、ロボットがそれを模倣し、最終的に自律動作を完了できるようにします。 同様に、他のタスクを学習させるには、対応するビデオを入力するだけで済みます。 具体的な実施内容については当局は明らかにしていない。 しかし、トレーニングを完了するのにたった 10 時間しかかからないという事実を除けば、ロボットにコーヒーの淹れ方を教えるといった作業自体は難しくありません。 その中核となるのは模倣学習であり、これはCoRL'22(ロボット工学、学習に関する会議)に選ばれたVIOLAによって実現できます(オブジェクト中心の模倣学習フレームワークであり、推論にはTransformerをベースとし、長距離タスクに優れ、最先端の模倣学習アルゴリズムを45.8%上回ります)。 今年6月にリリースされたGoogleのHYDRAもこの分野に特化しており、粗粒度から細粒度までさまざまな制御を得意とし、自由に切り替えることができます。 スタンフォード大学の AME はウェイポイントに基づいており、コーヒーを作るなどのタスクにも非常に便利ですが、速度ははるかに遅くなります。 ロボット模倣学習に関連する研究成果としては、NVIDIAのHITL-TAMP、MimicGenなどもあるので、一つ一つ紹介することはしません。 2040年までにスティーブコーヒーテストに成功して挑戦できるのは誰でしょうか?図 01 のパフォーマンスは非常に優れています(たとえば、非常に高速です)が、多くのネットユーザーは次のようにコメントしています。 これは、私たちが想像するコーヒーを作るロボットとはまだ少し遠いものです。 例えば、カップを持ち上げてコーヒーマシンの下に置き、淹れた後にクリームと砂糖を加え、カップをトレイに置いて誰かのところに持って行くことはできますか? 実際、アップルの共同創業者であるスティーブ・ウォズニアック氏は、ロボットの自律性を評価するためにコーヒーテストを提案したことがある。 ロボットは、まず見知らぬ家に入り、次にキッチンを見つけ、道具(コーヒーメーカー、ケトルなど)と材料(コーヒー豆、砂糖、ミルクなど)を識別し、最後に一杯のコーヒーを淹れる必要があり、全体のプロセスは20分を超えてはなりません。 このテストでは、ロボットが未知の環境を移動し、物体を識別し、道具や材料を操作し、人間の指示に従う能力が試されます。 その結果、89%の人が賛成票を投じました。 希望はあると思いますか? |
<<: 注釈付きビデオの 1 フレームでセグメント機能を学習し、完全な監視パフォーマンスを実現できます。 Huake、時系列行動検出における新たなSOTAを達成
>>: 400 万のトークン コンテキスト、推論がさらに 46% 加速されました。最新のオープンソースソリューションはMITの結果をアップグレードし、推論コストをさらに削減します
[[430680]]科学技術の継続的な発展により、人工知能は人間の生活のあらゆる側面に関わるだけでな...
「FAIR研究科学者として、私は2024年にMITのEECS教授陣に加わります。」 AI分野の著名な...
この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...
農業の発展は人々の生存と社会の安定に関係しています。近年、農業需要の継続的な解放、農業労働力の継続的...
近年、人工知能の継続的な成熟に伴い、生体認証技術は生活のあらゆる分野に浸透し、コストが削減され、効率...
開発者にとって、クラウドベースの機械学習ツールは、機械学習を使用して新しい機能を作成し、提供する可能...
2017年3月、中国共産党中央委員会の政府活動報告に人工知能が記載され、人工知能は国家戦略となった。...
[[216218]]人工知能スピーカー2017年は人工知能が爆発的に発展した年であり、「人工知能元...
データセンターでの機械学習プロジェクトの開発に精通している読者は、データドリフトとコンセプトドリフト...
データ共有は依然として課題ですが、多くの組織はすでに AI の力をサプライ チェーン管理の 2 つの...