2024年のAIトレンド、このグラフをご覧ください、LeCun: オープンソースのビッグモデルがクローズドソースを上回る

2024年のAIトレンド、このグラフをご覧ください、LeCun: オープンソースのビッグモデルがクローズドソースを上回る

2023年ももうすぐ終わりです。過去1年間で、さまざまな大型モデルがリリースされました。 OpenAIやGoogleのようなテクノロジー大手が競争する一方で、もう一つの「勢力」が静かに台頭している。オープンソースだ。

オープンソースモデルは常に疑問視されてきました。それらは独自モデルと同じくらい優れていますか?独自モデルのパフォーマンスに匹敵できますか?これまでのところ、私たちはいくつかの点でしか近づくことができませんでした。それでも、オープンソース モデルは常に、私たちが感心するような実証的なパフォーマンスをもたらします。

オープンソース モデルの台頭により、ゲームのルールが変化しています。たとえば、Meta の LLaMA シリーズは、その高速な反復性、カスタマイズ性、プライバシーの点で人気が高まっています。これらのモデルはコミュニティ内で急速に進化しており、独自のモデルに強力な挑戦をもたらし、大手テクノロジー企業の競争環境を変える可能性があります。

しかし、それ以前は、ほとんどの人の発想は「感情」から生まれたものでした。今朝、Meta の主任 AI 科学者でチューリング賞受賞者の Yann LeCun 氏が突然こう叫びました。「オープンソースの AI モデルは、独自のモデルを超えつつあります。」

ARK Invest チームが作成したこのトレンド チャートは、2024 年の AI の発展を予測する可能性が高いものと考えられています。生成 AI におけるオープンソース コミュニティと独自モデルの開発を図表化します。

OpenAIやGoogleなどの企業が、自社の最新モデルについてより閉鎖的になり、あまり公表しなくなるにつれて、オープンソースコミュニティとその企業支援者であるMetaもそれに倣い、生成AIへのアクセスを民主化し、独自モデルのビジネスモデルに挑戦する可能性があるようだ。

この散布図には、さまざまな AI モデルのパフォーマンス パーセンテージが表示されます。独自のモデルは青で表示され、オープンソース モデルは黒で表示されます。 GPT-3、Chinchilla 70B (Google)、PaLM (Google)、GPT-4 (OpenAI)、Llama65B (Meta) などのさまざまな AI モデルのパフォーマンスをさまざまな時点で確認できます。

Meta が LLaMA を初めてリリースしたとき、パラメータの数は 70 億から 650 億の範囲でした。これらのモデルのパフォーマンスは非常に優れています。130億のパラメータを持つLlamaモデルは、ほとんどのベンチマークでGPT-3(1750億のパラメータ)よりも優れており、単一のV100 GPUで実行できます。また、650億のパラメータを持つ最大のLlamaモデルは、GoogleのChinchilla-70BおよびPaLM-540Bに匹敵します。

Falcon-40B はリリース直後から Huggingface の OpenLLM ランキングでトップとなり、Llama だけが目立っていた状況を変えました。

Llama 2 はオープンソースであり、大規模モデルの世界に再び大きな変化をもたらします。 Llama 1 と比較して、Llama 2 はトレーニング データが 40% 多く、コンテキストの長さが 2 倍になり、グループ化されたクエリ アテンション メカニズムを使用します。

最近、オープンソースのビッグモデルの世界に、Yi モデルという新たなヘビー級メンバーが加わりました。一度に 40 万個の中国語文字を処理でき、中国語と英語の両方を処理できます。 Yi-34Bは、これまでにHugging Faceオープンソースモデルランキングでトップを獲得した唯一の国産モデルとなった。

散布図に示されているように、オープンソース モデルのパフォーマンスは独自のモデルに追いついています。これは、近い将来、オープンソース モデルのパフォーマンスが独自モデルに匹敵するか、それを上回ることが期待されることを意味する可能性があります。

先週末、Mistral 8x7B が最もシンプルな方法で強力なパフォーマンスを備えてリリースされ、研究者は「クローズドソースのビッグモデルは終わりを迎えた」とコメントしました。

一部のネットユーザーは、「2024年はオープンソースAIの年になるだろう」と期待し始めている。「私たちは重要なポイントに近づいています。オープンソースコミュニティプロジェクトの現在の開発速度では、今後12か月でGPT-4のレベルに到達するでしょう。」

オープンソース モデルの将来が順調に進むかどうか、またそれがどのように機能するかについては、待って見守る必要があります。

<<:  GPT-4Vがロボットの頭脳として機能すると、AIで計画を立てることができなくなる可能性があります

>>:  アマゾンのドローン配送部門の主要メンバーが目標未達成で辞任

ブログ    

推薦する

顔認識の背後にあるセキュリティリスクを誰が負担するのでしょうか?

近年、科学技術の発展に伴い、顔認識技術は人々の日常生活で頻繁に使用されるようになりました。たとえば、...

Tofsee ボットネットは独自のドメイン名生成アルゴリズムを使用する

概要スイス政府コンピュータ緊急対応センター (GovCERT) は最近、Tofsee ボットネット ...

自動運転車の4つの重要な要素:2040年までに市場価値500億ドル

自動運転車は自動車業界にとって非常に破壊的な技術です。現在、多くのメーカーが物流、自動運転タクシー、...

スタンフォード大学のAIアルゴリズムは死を予測できる!これはホスピスにとって良いことかもしれない…

人工知能を使って患者の死期を予測するというのは、ディストピアSFシリーズ『ブラック・ミラー』のような...

写真やビデオをロスレスで拡大しますか?これら2つのAIツールは持つ価値がある

編集者として、執筆という主な仕事に加えて、イラストレーションという非常に重要な問題を考慮する必要があ...

...

GPT-5が稼働を開始しました!ウルトラマン:月7億では足りない。マイクロソフトがもっと投資してくれることを願う

月収7億元でもGPTのトレーニングへの巨額の投資を賄うことはできません。これはOpenAIのCEO、...

...

大規模なモデルでプロンプト内のより多くの例を学習させたい場合は、この方法を使用すると、より多くの文字を入力できます。

GPT や LLaMA などの大規模な言語モデルを使用する場合、入力プロンプトに文字数制限があるこ...

1780億のパラメータを持つこの言語モデルは、王者GPT-3に挑戦するためだけに作られたのでしょうか?

誰かがGPT-3の独占に挑戦しなければなりません! GPT-3 は発売以来、最大の AI 言語モデル...

...

彼女に転送してください!文系女子でもわかるAIガイドライン

マッキンゼーのデータによれば、人工知能は今後10年間で米国に約13兆ドルの新たなGDPを生み出すだろ...

うつ病に苦しむ5400万人の人々に直面し、600人のボランティアはAIを使って彼らを救うつもりだ

2019年、21歳の中国人学生、李凡は自身の微博に書き込みをした後、薬を飲んで自殺した。その後の調査...

人工知能、ロボット工学、そして道徳的リスク

人工知能は、産業用ロボットやロボットプロセス自動化 (RPA) における新たなアプリケーションを推進...