GoogleはAIを使って「ヘッドフォンケーブル」をトレーニングし、タッチスクリーンのほとんどの機能を実現

この記事はAI新メディアQuantum Bit（公開アカウントID：QbitAI）より許可を得て転載しています。転載の際は出典元にご連絡ください。

Google は、Levi's と共同で発売したスマートジャケット Commuter Trucker など、ウェアラブルデバイスの開発を止めたことはありません。

衣服の袖口にセンサーが追加され、ユーザーは Bluetooth リンクを介してセンサーと対話できます。

ダブルクリックやスライドなどで曲の切り替えなどの操作が行えます。

Google は、引き続き努力することで、デバイスをより小型化し、より機能的にしたいと考えています。

その後、Google はヘッドフォンケーブルに目を向けました。

GoogleのAIエンジニアは、つまむ、こする、持つ、叩くなどのジェスチャーを通じて、従来のタッチスクリーンの機能のほとんどを実現できる電子インタラクティブファブリック（E-Textile）を開発しました。

音量調節、曲の切り替えなどの操作もまったく問題ありません。Google の新機能は、私たちの手を自由にするという究極の目標を掲げ、知覚的インタラクションの次のステップを示しています。

ジェスチャーデータセットのトレーニングプロセス

Google が開発したこのデバイスは、機械学習アルゴリズムとセンサーハードウェアを組み合わせたもので、ヘッドホンケーブルは単なるキャリアに過ぎません。

実際、このケーブルは普通のヘッドホンケーブルではなく、センサーが織り込まれた柔軟な電子素材なので、人間とコンピューターの相互作用が可能です。

パーカーもお好みに応じて変形できます。

まず、Google はデータ収集のために 12 人の参加者を募集しました。各参加者は8 つのジェスチャーを 9 回繰り返し、合計 864 個の実験サンプルを作成しました。

サンプルサイズが小さすぎる問題を解決するために、研究者は線形補間を使用して各ジェスチャの時系列を再サンプリングしました。

各サンプルに対して16 個の特徴が抽出され、最終的に80 個の観測値が得られました。

トレーニングされたジェスチャ認識により、ユーザーごとに8 つの新しい個別のジェスチャが可能になります。

研究者たちは、定量的な数字だけでなく参加者の個人的な感情も考慮した、人間中心のインタラクティブな体験を提供したいと考えています。

参加者はランキングやコメントを通じて定性的なフィードバックも提供し、スワイプ、フリック、押す、つまむ、引っ張る、握るなど、さまざまなインタラクション方法を提案しました。

定量分析の結果、インタラクティブファブリックは既存のヘッドフォンボタンコントロールよりも速く認識され、タッチスクリーンと同等の速度であることが示されました。

定性的なフィードバックからも、電子テキスタイルインタラクションの方がヘッドフォンワイヤーコントロールよりも人気があることが分かります。

研究者はさまざまな使用シナリオを考慮して、さまざまな使用シナリオに合わせてさまざまなデバイスを開発しました。

携帯電話でのメディア再生を制御する電子テキスタイルUSB-C イヤホン、衣服に目に見えない形で音楽コントロールを追加するパーカーの引き紐。

アルゴリズムがジェスチャーを正確に認識

Google にとって電子ファブリックを作る上での難しさは、機械学習アルゴリズムではなく、ヘッドホンコード上のジェスチャーをキャプチャして操作する方法にあります。

サイズ上の理由から、ヘッドフォンケーブルなどの織り素材には、大型で多数のセンサーを装備することができず、その認識能力と解像度は大幅に制限されます。

第二に、人間の手のジェスチャーの曖昧さと不明確さがあります。たとえば、つまむこととつかむことをどのように区別するのでしょうか。また、叩くことと引っ張ることをどのように区別するのでしょうか。

Google のエンジニアは8 つの電極を使用してセンサーマトリックスを形成し、データセットをトレーニングデータ用に 8 回、テストデータ用に 1 回に分割し、9 つのジェスチャー変換を取得しました。

彼らは、センサーマトリックスには機械学習分類アルゴリズムに非常に適した固有の関係があることを発見しました。これにより、分類アルゴリズムは限られたデータセットを使用してトレーニングされ、約30秒でジェスチャー認識を実現できます。

最終的な精度は 93.8% で、データセットのサイズと使用したトレーニング時間を考慮すると、日常使用には十分でした。

ヘッドフォンコントロールの次のステップ

今回 Google がヘッドフォンケーブルに施したトレーニングには、ジェスチャー認識とマイクロインタラクションという 2 つの側面が含まれています。

タッチスクリーンデバイスでは、画面の下のスペースに、Apple の 3D Touch 認識モジュールなどの多数のセンサーを配置できます。

しかし、ヘッドフォンケーブルなどの外部デバイスの場合、センサーの数とサイズが制限されているため、それほど簡単ではない可能性があります。

実験中、エンジニアは、複数のジェスチャーには複数のトレーニングが必要であり、異なる個々のジェスチャーを複数回キャプチャする必要があることを発見しました。

この研究は、コンパクトなフォームファクターで精密な小規模動作を実現できることを示しており、スマートでインタラクティブなファブリックの開発が期待できます。

ある日。ウェアラブルインターフェースとスマートファブリックのマイクロインタラクションは任意に使用できるため、最終的には体外デバイスがどこにでも私たちと一緒に移動し、いつでもインタラクトできるようになり、私たちの手が自由になります。

この日を楽しみにしていますか？

<<: このおもちゃからヒントを得たアクチュエータは、ソフトロボットにジャンプする能力を与える可能性がある。

>>: 世界初の3D AI合成キャスターがデビューし、2つのセッションの取材にも参加。ネットユーザー：キャスターは失業中

GoogleはAIを使って「ヘッドフォンケーブル」をトレーニングし、タッチスクリーンのほとんどの機能を実現

ジェスチャーデータセットのトレーニングプロセス

アルゴリズムがジェスチャーを正確に認識

ヘッドフォンコントロールの次のステップ

AIの恋人の唆しでエリザベス女王暗殺未遂の罪で懲役9年の判決を受けた男

世界中の経営幹部の93%がAIに期待を抱いているが、65%はまだその恩恵を受けていないと答えている。

人工知能と5Gの組み合わせは医療業界の診断と治療のモデルとプロセスを変えるだろう

[NCTSサミットレビュー] Rong360 Ai Hui: AIモデルテストの秘密を探る

「コーチ」はとても優しくて合格率も高いです！上海に「無人運転訓練」が登場。試してみませんか？

Google、チャットボットデータ分析プラットフォーム「Chatbase」の開設を発表

AIの奇妙な使い方：マクドナルドはゴミ箱の監視にAIを活用

IBM Li Hongyan: 顧客の視点から「クラウドコンピューティングとデジタルインテリジェンスの活用」を考える

これを読めば、大きな整数の乗算と分割統治アルゴリズムを学ぶことができます。

推薦する

テスラが自社開発したスーパーコンピュータDojo！日本の「富岳」に代わる世界初の

クンペンが離陸、ソフトコムが道路を建設、ソフトコム・ウィズダムがファーウェイと手を組み、済南を科学技術革新の高原に築く

ネイチャーの表紙に掲載されているこのグループ学習は、中央コーディネーターを必要とせず、連合学習よりも優れています。

エッジAIとは何ですか?

人工知能をゼロから学ぶのは難しくない

AI の知覚を人間の知覚と直接比較できないのはなぜですか?

.Net Framework ガベージコレクション固有のアルゴリズムの詳細な説明

機械学習研究開発プラットフォームの選択

人工知能とサイバーセキュリティは諸刃の剣

AIの4つのタイプについてお話しましょう

科学者らが自己再生材料に使える3Dプリント「生きたインク」を開発

GPT-3 がプログラミングを支配: AI はコーディングの仕事を殺すのか?

AIイノベーションの解放：自然言語処理技術とアプリケーション

大手モデルサークルは「GPU が貧弱」について熱く議論している。Google の計算能力は他のすべての企業を合わせたよりも高いことが明らかになり、スタートアップに打撃を与えている。