コードを入力すること、詩を書くこと、論文を書くこと、すべてが可能です!史上最大のAIモデルGPT-3がGithubを席巻

コードを入力すること、詩を書くこと、論文を書くこと、すべてが可能です!史上最大のAIモデルGPT-3がGithubを席巻

[[334935]]

最近、GPT-3が人気になってきました!インターネット上で GPT-3 のさまざまなデモをご覧になったことがあると思います。 OpenAI によって作成されたこの大規模な機械学習モデルは、独自の論文を書くだけでなく、詩を作曲したり、独自のコードを書いたりすることもできます。

GPT-3 の威力を見てみましょう。まず、質問応答タスクにおける GPT3 のパフォーマンスを見てみましょう。

あなたの質問が素晴らしい頭の体操であろうと、高度に論理的な数学の問題であろうと、それは流暢に答えることができます。

開発者の Sharif Shameem 氏は、ビデオに示されているように、必要なレイアウトを入力するだけで JSX コードを生成するジェネレーターを GPT-3 を使用して作成しました。

また、誰かが Google スプレッドシートで新しい GPT3 関数を開発しました。この関数は、簡単な数学演算に加えて、米国の各州の人口と建国年を自動的に見つけることができます。

さらに、Twitter アカウントも見つけることができます:

残念ながら、GPT-3 を試したい場合は、まず試用ライセンスを取得する必要がありますが、このモデルによって作成されるアプリケーションは無限にあるようです。これを通じて、平易な英語で SQL データベースをクエリしたり、コードに自動的に注釈を付けたり、コードを自動的に生成したり、人気のある記事のタイトルを書いたり、さらには人気のある記事を書くのを手伝ったりすることができます。

GPT-3とは何ですか?

GPT-3 はニューラル ネットワークを活用した言語モデルです。ほとんどの言語モデルと同様に、GPT-3 はラベルなしのテキスト データセット (トレーニング データには Common Crawl と Wikipedia が含まれます) で広範囲にトレーニングされます。テキストから単語やフレーズがランダムに削除され、モデルは周囲の単語のみをコンテキストとして使用して単語やフレーズを埋めることを学習する必要があります。これは、強力で一般化可能なモデルを生成する単純なトレーニング タスクです。

GPT-3 モデル アーキテクチャ自体は、単方向トランスフォーマー言語モデルに基づいています。このアーキテクチャは 2 ~ 3 年前に人気になりました。人気の NLP モデル BERT と GPT-3 の前身である GPT-2 はどちらもトランスフォーマー上に構築されています。アーキテクチャの観点から見ると、GPT-3 は実はあまり目新しいものではありません。

GPT-3 が人気の理由は、モデルサイズが 1,750 億にまで増加し、45 TB のデータを使用してトレーニングされているため、これまでに作成された最大の言語モデルとなっていることです。巨大なパラメータモデルのおかげで、他のモデルではできない多くのことを実現できます。前述のように、翻訳者、作家、詩人、プログラマーなどにすることができます。

GPT-3 の 1750 億のモデルパラメータが少し抽象的だと思うなら、例を挙げて理解してもらえるはずです。

  • BERTモデルには3億のパラメータがある
  • GPT-3モデルの前身であるGPT-2には15億のパラメータがある
  • NvidiaのMegatron-BERTには80億のパラメータがある
  • 170億のパラメータを持つMicrosoft Turing NLP

2位のMicrosoft Turing NLPのデータパラメータでさえ、GPT-3と同じレベルではありません。

GPT-3 論文の著者は 31 名で、論文は 72 ページにも及ぶことは特筆に値します。ネットユーザーからは、「論文のページ数を競い合うのは PTM の仕事なのか?」という声が上がっています。

いつものように、GPT-3 はすぐに GitHub プロジェクト ページをリリースしました。そこではさまざまな興味深いデモを見つけることができ、最後に Github アドレス: https://github.com/openai/gpt-3 も見つかります。

<<:  ロボット犬をDIYするにはどれくらいの費用がかかりますか?価格は900ドルと安く、スタンフォード大学が開発し、コードはオープンソースです

>>:  Appleは10年間で28社のAI企業を売却。そのAI戦略は世間の注目を集めることだ!

ブログ    
ブログ    

推薦する

COVID-19により公益事業の人工知能への移行が加速

人工知能 (AI) は、医療から自動車、小売、ファーストフードまで、考えられるほぼすべての業界で幅広...

...

セキュリティ業界における5G+AIの探究と実装

セキュリティ業界における5G+AIの活用により、高解像度ビデオはセキュリティ業界に重要な発展の機会を...

目から鱗!ヘルスケアと自動車業界における AI の興味深い応用例 11 選

この記事は公開アカウント「Reading Core Technique」(ID: AI_Discov...

このマウスはFPSゲームのプレイ方法を自ら学習し、トレーニングの精度はプロのプレイヤーと同等です。

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

自然言語処理が人工知能の中核である理由

コンピュータが人間を騙して自分は人間だと信じ込ませることができるなら、そのコンピュータは知的であると...

...

マスク氏と陳天橋氏の両者が期待している脳コンピューターインターフェースは、将来いつ実現するのだろうか?

[[415853]]失語症の人は再び話せるようになり、聴覚障害の人は再び聞こえるようになり、四肢麻...

TensorFlow を使い始めるための重要なポイントをここにまとめました。まだ怠ける理由がありますか?

この記事の著者である Steven Dufresne は、初心者が TensorFlow を学習する...

ウェブデザインに人工知能を活用する10の方法

[[210916]]今日、Web デザインは絶えず進化しており、トップクラスの Web デザイナーは...

AI大学院生は年間50万元を稼ぐことができるが、彼らの給料は学校を卒業する前からすでに奪われている。

先週末、人工知能が素晴らしい動きを披露した。ボストン・ダイナミクスのロボット「アトラス」は完璧なバク...

自然言語処理による検索分析とは何か、なぜそれがビジネスにどのように役立つのか

組織が高度な分析ソリューションを検討している場合、IT チームと管理チームはおそらく何らかの調査と分...

...

コンピュータービジョン: 画像検出と画像セグメンテーションの違いは何ですか?

人工知能における画像処理人工知能には画像処理のためのさまざまなタスクがあります。この記事では、物体検...