ByteDanceが大規模モデルトレーニングフレームワークveGiantModelをオープンソース化、パフォーマンスが最大6.9倍向上

ByteDanceが大規模モデルトレーニングフレームワークveGiantModelをオープンソース化、パフォーマンスが最大6.9倍向上

最近、ByteDanceの応用機械学習チームは、veGiantModelという大規模モデルトレーニングフレームワークをオープンソース化しました。このトレーニングフレームワークは、主に自然言語処理分野の大規模モデルトレーニングに使用され、大規模モデルトレーニングのパフォーマンスを最大6.9倍向上させ、トレーニングシステムへの負荷を大幅に軽減します。現在、ByteDance 傘下のエンタープライズ レベルのテクノロジー サービス プラットフォームである Volcano Engine は、パブリック ベータ版である機械学習プラットフォームで veGiantModel をネイティブにサポートしています。

自然言語処理は、コンピューターが人間の言語を理解、解釈、使用できるようにすることを目的とした人工知能研究の重要な分野です。近年、自然言語処理は、主に BERT、GPT、GPT-3 などの事前トレーニング済み言語モデルの普及により、アプリケーションにおいて大きな進歩を遂げました。事前学習済みの言語モデルは、人工知能の分野ではインフラとなっていると言えます。大規模モデルの方がアルゴリズムのパフォーマンスが優れているため、事前トレーニング済みの言語モデルは近年、大規模モデルへの急速な傾向を示しています。しかし、モデル サイズの急速な増加は、主にメモリの圧力、コンピューティングの圧力、および通信の圧力に反映され、既存のトレーニング システムにかなりの課題をもたらしました。

大規模モデルのトレーニング シナリオにおいて既存のトレーニング システムが直面する上記の課題に対応するため、ByteDance の応用機械学習チームは、大規模モデル トレーニング フレームワーク veGiantModel を提案しました。

veGiantModel の中国語名は Volcano Engine Large Model Training Framework です。これは、オープンソースのディープラーニング フレームワーク PyTorch をベースにした高性能な大規模モデル トレーニング フレームワークであり、2 つの主要なオープンソースの主流トレーニング フレームワークである Megatron と DeepSpeed を基盤として構築されています。

veGiantModel は、データ並列、演算子分割、パイプライン並列の 3 つの分散並列戦略を同時にサポートでき、自動化およびカスタマイズされた並列戦略をサポートします。Byte が開発した高性能非同期通信ライブラリである ByteCCL に基づいて、veGiantModel のトレーニング タスク スループットは、他の主流のオープン ソース フレームワークよりも 1.2 ~ 3.5 倍高く、より使いやすく柔軟なパイプライン サポートを提供し、モデル開発と反復に必要な人員を削減します。さらに、veGiantModel は、数十億から数千億のパラメーターを持つ大規模なモデルを GPU 上で効率的にサポートでき、ネットワーク帯域幅の要件が低く、プライベートに展開する場合に RDMA に大きく依存しません。

MegtraonとDeepSpeedとの比較テストでは、veGiantModelが最も優れたパフォーマンスを発揮し、ネットワーク帯域幅の影響が最も少ないことが示されました。Tesla V100では上記2つよりも1.2~3.5倍、Ampere A100では最大6.9倍のパフォーマンス向上が見られました。


veGiantModel オープンソースアドレス:

https://github.com/volcengine/veGiantModel

Volcano Engine 機械学習プラットフォーム パブリックベータ アドレス:

​​https://www.volcengine.com/product/ml-platform​​


<<:  自動運転トラックはレベル4を達成する可能性が最も高いが、自動運転車は2022年まで待たなければならない

>>:  ロボットをもっと速く走らせたい?人工知能で制御しよう

ブログ    

推薦する

IDC:2026年までに国内市場の端末のほぼ半数がハードウェアレベルのAIエンジン技術を搭載

市場調査会社IDCは7月25日、近年の人工知能の急速な進化と発展により、ビッグデータモデルはますます...

なぜ今でもMocha DHT-PHEVのような電源ソリューションが必要なのでしょうか?

2021年、国内の新エネルギー乗用車市場はチップ不足や電池原材料価格の高騰など予想外の事態に見舞わ...

知覚AIオペレーティングシステム

AI、つまり人工知能の新たな波が到来します。機械学習、ディープラーニング、ニューラルネットワーク、音...

魂への窓!人工知能は網膜をスキャンして心臓発作を予測できる

ビッグデータダイジェスト制作眼鏡をかければ心臓発作の危険があるかどうかがわかるなんて、驚きですよね?...

ランセットの最新記事:主要都市での流行は武漢より1~2週間遅れる

一方で感染症の予防と抑制、他方で春節の旅行ラッシュの帰省があり、今年の仕事再開への道のりは異例のもの...

Megvii 顔認識ビジネス講演シリーズ - 顔認識について知っておくべきこと

人工知能、機械学習、マシンビジョンとは具体的に何でしょうか?顔認識と人工知能の関係は何でしょうか?人...

ネットユーザーたちは、顔認識技術の何が難しいのかと冗談を言っている。

今朝、ジャック・マーは自身の微博に「ドイツで開かれたCEBITカンファレンスの開幕式が終わったばかり...

ザッカーバーグは7億ドルの配当金を受け取り、Metaの株価は14%急騰、オープンソース計画は成功したのか?

メタの株価は木曜日の時間外取引で14%近く上昇し、史上最高値に達したが、同社は初の配当を発表した。最...

トラフィックを30%削減し、鮮明度を向上: MITが新しいAIビデオキャッシュアルゴリズムを提案

オンラインビデオの読み込み速度と鮮明さに対する人々の要求は常に尽きることがありません。最近、マサチュ...

2022年のデータサイエンスとAIの予測

2021 年には技術変化のペースが加速し、歴史が示すように、2022 年もそのペースは加速し続けるで...

AI音声アシスタントと仮想IP画像の組み合わせは、ブランドマーケティングの新たな名刺になるかもしれない

最近、世界インターネット会議で「世界インターネット発展報告書2020」が発表されました。報告書では、...

金メダルレベルの数学スキル:DeepMindの幾何学的推論モデルがNatureに掲載され、コードはオープンソースで、フィールズ賞受賞者が賞賛

今回、人工知能アルゴリズムが国際数学オリンピック(IMO)で大きな進歩を遂げました。本日発行された国...

李開復「2021年を予測」:4つの主要分野が前例のない発展の機会をもたらす

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

ロボットはついにデータセンターで活躍の場を見つけるのでしょうか?

ロボットは長い間、人々の探究心を呼び起こしてきたが、同時に説明のつかない恐怖ももたらしてきた。しかし...

...