この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式サイトにアクセスして許可を申請してください。 マイクロソフトは本日、数兆個のパラメータ(予測の根拠となるモデル内の変数)を含む AI モデルをトレーニングする新しい方法を導入する DeepSpeed ライブラリの更新バージョンをリリースしました。 Microsoft によれば、3D 並列処理と呼ばれるこのテクノロジは、さまざまなワークロードのニーズに適応でき、特に電力を大量に消費する非常に大規模なモデルの効率をバランスさせることができるという。
数十億のパラメータを持つ単一の大規模 AI モデルにより、さまざまな困難な領域で大きな進歩が可能になりました。研究によると、AI が優れたパフォーマンスを発揮できるのは、言語、文法、知識、概念、文脈のニュアンスを理解できるためであり、スピーチを要約したり、リアルタイムのゲーム チャットで不適切な単語を除外したり、複雑な法的文書を解析したり、さらには GitHub を検索してコードを生成することも可能になります。 しかし、モデルのトレーニングには大量のコンピューティング リソースが必要です。 2018年のOpenAIの分析によると、大規模なAIトレーニングに必要なコンピューティング能力は2012年から2018年にかけて30万倍に増加し、およそ3.5か月ごとに倍増し、ムーアの法則のペースをはるかに上回っています。 強化された DeepSpeed は、データ並列トレーニング、モデル並列トレーニング、パイプライン並列トレーニングという 3 つの技術を活用して、「兆スケール」のモデル トレーニングを可能にします。 1兆パラメータのモデルをトレーニングするには、少なくとも400個のNvidiaの最新A100 GPU(それぞれ最大40GBのメモリを搭載)が必要であり、Microsoftは50%の効率で稼働する4,000個のA100が必要で、トレーニングを完了するには約100日かかると見積もっています。これは、1万枚以上のグラフィックカードを搭載した、マイクロソフトとOpenAIが共同設計したAIスーパーコンピューターにはかないません。これほどの大規模環境では、高い計算効率を達成することは困難です。 DeepSpeed は、大規模なモデルを 4 つのパイプライン ステージに分割し、さらに小さなコンポーネント (レイヤー) に分割します。各パイプライン ステージのレイヤーは、実際のトレーニングを実行する 4 つの「ワーカー」にさらに分割されます。各パイプラインは 2 つの並列データ インスタンス間で複製され、ワーカーはマルチ GPU システムにマップされます。 Microsoft によれば、これらおよびその他のパフォーマンスの改善により、1 兆パラメータの AI モデルのトレーニングに必要な Nvidia V100 GPU をわずか 800 個に削減できるという。 DeepSpeed の最新バージョンには、GPU とそのホスト CPU 上のコンピューティング リソースとメモリ リソースを活用して、単一の V100 で最大 130 億のパラメータを持つモデルをトレーニングする ZeRO-Offload テクノロジーも含まれています。マイクロソフトは、これは最先端のものより 10 倍強力であり、データ サイエンティストはより少ないコンピューティング リソースを使用してトレーナーをトレーニングできると主張しています。 「これら(DeepSpeed の新技術)は、極めて高い計算、メモリ、通信効率を提供し、数十億から数兆のパラメータを持つモデルのトレーニングをサポートします」と Microsoft はブログ投稿で述べています。「これらの技術により、極めて長い入力シーケンスも可能になり、単一の GPU、数千の GPU を備えたハイエンド クラスター、または非常に低速のイーサネット ネットワークを備えたローエンド クラスターを備えたハードウェア システムのパワーが解放されます。当社は、ディープラーニング トレーニングの速度と規模の限界を押し広げながら、急速に革新を続けます。」 |
<<: 企業がAI対応データベースを使用してAI導入を加速する方法
>>: 役立つ情報 | 115 行のコードで数独パーサーを作成する方法を段階的に説明します。
6月19日、第17回IEEEコンピュータ協会バイオメトリクスワークショップ(CVPR22)とAnt...
バード家のバケツがついに登場! Bard は今年 3 月にリリースされ、6 か月後、ようやく独自のプ...
[[263741]]自動運転は短期間で実現できるのか?数年前なら、大手各社はおそらく肯定的な答えを...
この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...
この記事は、公開アカウント「Reading the Core」(ID: AI_Discovery)か...
2021年6月23日、「変革の新パラダイム」をテーマにした2021年第4回パラダイム会議および企業イ...
近年、人工知能(AI)は芸術作品の創造において驚くべき能力を発揮しています。テキストボックスに文章を...
優れた機械学習研究者になるために必要な資質は何でしょうか? 強力なコーディングスキルでしょうか? そ...
51CTO 編集者注: 「Java ガベージ コレクション メカニズムの簡単な分析」では、Java ...
ほとんどの人がロボットについて考えるとき、映画に出てくる歩くロボット、掃除機、産業用ロボットなどを想...
[[214638]]ノイズ除去オートエンコーダー (DAE) は、破損したデータを入力として受け入...
[[430922]]文中の次の単語を予測するようにトレーニングされた機械学習ベースの言語モデルは、ま...
「2018年中国人工知能商業上陸研究報告」によると、過去1年間、業界は人工知能に大きな期待を寄せ、...
最近、快手の内部インキュベーターである快手幸福実験室が主催した第2回ハッカソン「AIの名において」の...