言葉を発することなくSiriに命令しましょう!清華大学の卒業生が「無言言語認識」ネックレスを開発

言葉を発することなくSiriに命令しましょう!清華大学の卒業生が「無言言語認識」ネックレスを開発

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。

これは今、Siriとコミュニケーションをとる最もファッショナブルな方法かもしれません——

唇を動かすだけで、コントロールできます。

そうです、音を必要としないタイプです。

これはコーネル大学の中国チームの最新の研究結果である。   SpeeChin 、無音音声認識。

このような:

音がまったく聞こえない状態で、彼が何を言っているかわかりますか? (答えは記事の最後で明らかにされます)

しかし、SpeeChinのおかげで、Siri、Alexaなどが認識できるようになり、中国語と英語もサポートされるようになりました。

「この瞬間、音よりも沈黙の方が良い」という感覚があります。

話さずに音声アシスタントを制御するにはどうすればいいですか?

コーネル大学チームが開発したSpeeChinは、実は魔法のネックレスです。

このネックレスを身に着けると、サイレントボイスコントロールへの扉が開かれます。

たとえば、コンピューターに「次へ」と静かに言うと、音楽は自動的に次の曲に切り替わります。

単語が簡単すぎると思うかもしれませんが、心配しないでください。今度は難易度を上げてみましょう。

「テイラー・スウィフトに切り替えて。」

SpeeChinは完全な文章でも正確に認識できることがわかります。

この「サイレント識別」ネックレスの鍵は、ネックレスの下に設置された赤外線カメラにあります。

人の首や顔の皮膚の変形画像を撮影し、「口」からどのような命令が伝えられているかを分析して識別できる。

さらに、このネックレスは英語だけでなく中国語も認識できます  (北京語)も我慢できます。

最初の実験では、20人がテストに参加し、そのうち10人は英語を話し、残りの10人は中国語を話しました。

研究者らは、テスト参加者に、数字、対話型コマンド、音声アシストコマンド、句読点コマンド、ナビゲーションコマンドなど、英語と中国語で数十のコマンドを発行するよう依頼した。

最終的な実験結果では、「サイレント認識」の精度はそれぞれ90.5%91.6%に達したことが示されました。

コーネル大学の中国チーム

この研究はコーネル大学からのもので、第一著者はRuidong Zhang氏です。

そのうち、Cheng Zhang氏が本研究の責任著者である。

彼はコーネル大学情報科学部の助教授です。彼の研究は、インタラクション、健康センシング、活動認識などのさまざまな応用分野における現実世界の課題に対処するために、人体とその周囲に関する情報を取得する方法に焦点を当てています。

この研究の第一著者は、清華大学で学士号を取得した張程教授の博士課程の学生、張瑞東氏である。

彼の研究対象は、人間とコンピュータのインタラクションとユビキタスコンピューティングで、特にインタラクティブな体験を促進し、人間の行動に対する理解を深めるための新しいタイプのウェアラブルデバイスの構築です。

なぜこの仕事をしたいのか、Ruidong Zhang さんは次のように説明した。

これは主に、特定の状況では、人々が音を出すことが適切ではない可能性があるという事実によるものです。また、話すことができない人もいるという事実によるものです。

最後に、オープニング GIF の答えを明らかにしましょう。

正解でしたか?

<<:  2022年にJAXを使うべきでしょうか? GitHubには16,000個のスターがあるが、この若いツールは完璧ではない

>>:  ISPの廃止はテスラの「純粋なビジョン路線」にとって重要なステップ

ブログ    
ブログ    

推薦する

2019 年の NLP における最先端のブレークスルーを振り返る

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

人工知能は視覚効果アーティストの役割に取って代わるでしょうか?

視覚効果 (VFX) の分野における AI の統合は、シームレスでデータ主導のアプローチを導入するこ...

...

人工知能を理解するのに役立つ記事(画像付き)

近年、人工知能(AI)が普及するにつれ、その原理を理解できずにAIを迷信し崇拝する人が増えています。...

...

...

先頭に立つ! 16人の学際的な専門家がAIの次の10年について語る

ニューヨーク大学の心理学・神経科学教授ゲイリー・マーカス氏と、ディープラーニングの先駆者で2018年...

馬懿、沈向陽、曹英の最新AIレビューが人気に!作成に3か月かかりました。ネットユーザー必読の論文です

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

PyTorch スキルを向上させる 7 つの実用的なヒント (例付き)

[[399124]] PyTorch は、動的ニューラル ネットワーク (if ステートメントや ...

ロボットを活用する3つの革新的な方法

ロボットは、高齢の両親を助けたり、子供を教育したり、料理をしたりすることができます。ロボット産業は創...

超高性能+究極のアプリケーション、Powerleader AIサーバーがインテリジェントな開発を促進

現在、クラウドコンピューティングやAIなどの技術の出現により、データセンター設計の構造的変化が進み、...

大規模ウェブサイトのアルゴリズムとアーキテクチャに関する簡単な説明

順序先月、上司が「大規模ウェブサイトのアルゴリズムとアーキテクチャに関する簡単な説明」という講義をし...

梅雨から台風シーズンまで、ドローンが再び活躍

最近、静かに梅雨の季節が去り、猛烈な台風の季節が勢いよくやって来ています。 [[336317]] 8...

3分レビュー! 2021年5月の人工知能分野における重要な進展の概要

近年、社会経済の発展に伴い、人工知能技術は科学技術の最前線に立っています。テクノロジーが成熟するにつ...