大規模モデルの開発動向はオープンソースへと移行し始めています。 周知のとおり、ChatGPT、GPT-4などのスターモデルはオープンソースではありません。それに応じて、オープンソース分野では、Metaが最近リリースしたLlama 2が、無料かつ商用利用可能な大規模モデルシリーズとして特に注目を集めています。 今日、オープンソース分野にもう一つの朗報が届きました。AIモデルコミュニティModelScopeが、Qwen-7BとQwen-7B-Chatという2つのオープンソースモデルを発表しました。Alibaba Cloudは、これらがTongyi Qianwenの70億パラメータ汎用モデルと対話モデルであることを確認しました。 最も重要なのは、どちらのモデルもオープンソースで、無料で、市販されていることです。
具体的には:
オープンソース コードは、Qwen-7B および Qwen-7B-Chat の量子化をサポートし、ユーザーがコンシューマー グレードのグラフィック カードにモデルを展開して実行することをサポートします。 モデルをダウンロードしたいユーザーは、MoDa コミュニティから直接モデルをダウンロードするか、Alibaba Cloud Lingji プラットフォームを通じて Qwen-7B および Qwen-7B-Chat にアクセスして呼び出すことができます。Alibaba Cloud は、モデルのトレーニング、推論、展開、微調整など、幅広いサービスをユーザーに提供します。 実際、アリババクラウドは今年4月にはすでに自社開発のビッグモデル「Tongyi Qianwen」をリリースしており、今回の2つのオープンソースモデルは研究者がビッグモデルを利用するハードルを大幅に下げた。この動きにより、アリババクラウドは中国で初めて大規模モデルオープンソースの仲間入りを果たした大規模テクノロジー企業となる。 複数の権威ある評価において、Tongyi Qianwen 7B モデルは国内外の同規模のモデルをはるかに上回る結果を達成し、業界最強の中国語と英語の 7B オープンソース モデルとなりました。 Tongyi Qianwen 7B 事前トレーニング済みモデルは、複数の権威あるベンチマーク評価で優れたパフォーマンスを発揮しました。中国語と英語の機能は、国内外の同規模のオープンソース モデルの機能をはるかに上回っており、一部の機能は 12B や 13B 規模のオープンソース モデルの機能さえ上回っています。 英語能力評価ベンチマーク MMLU では、Tongyi Qianwen 7B モデルは、主流のオープンソース モデル 7B、12B、13B よりも高いスコアを獲得しました。このベンチマークには 57 の分野からの英語の質問が含まれており、人文科学、社会科学、科学、工学の総合的な知識と問題解決能力がテストされます。 中国の常識能力評価ベンチマーク C-Eval では、Tongyi Qianwen は検証セットとテストセットの両方で最高得点を獲得した 7B オープンソース モデルであり、その堅実な中国語能力を実証しています。 数学の問題解決能力評価の GSM8K やコーディング能力評価の HumanEval などのベンチマークでも、Tongyi Qianwen 7B モデルは優れたパフォーマンスを発揮し、同サイズのすべてのオープンソース モデルや一部の大規模オープンソース モデルを上回りました。 Alibaba Cloudは、オープンソースのビッグモデルは、ユーザーがモデルのトレーニングと展開のプロセスを簡素化するのに役立つと述べました。ユーザーはモデルをゼロからトレーニングする必要はありません。事前にトレーニングされたモデルをダウンロードして微調整するだけで、高品質のモデルを迅速に構築できます。 Tongyi Qianwen のオープンソース化により、より多くの企業や機関がこの仲間入りを果たし、より多くの研究者に利便性をもたらすようになると信じています。 |
<<: マスク氏がai.comドメイン名を購入しました!ウルトラマンは数千万ドルを費やしてそれを購入し、4ヶ月でアイアンマンに売却した
>>: Jupyter のアップグレード: さまざまな大規模モデルを接続し、コードを生成し、チャットを通じてエラーを修正できます
最近、ニューヨークタイムズの年次ディールブックサミットで、黄仁勲氏は、汎用人工知能(AGI)を「かな...
[[206924]]自然言語処理の分野では、ディープラーニングによって、より多くのデータが必要でも言...
今日、人工知能について話すとき、私たちは数学モデルを使用してデータからパターンの表現を抽出することで...
科学技術分野において、国境を越えた融合による新しいものによってもたらされる破壊的な競争は、あくまでも...
AIは人間の感情を認識できるでしょうか?原理的には、AIは音声認識、視覚認識、テキスト認識、表情認識...
Raspberry Pi は、小さなおもちゃの車から産業用ロボットアームに至るまで、あらゆるものに...
生成 AI の時代が到来し、iPhone の時代が到来しました。 8月8日、NVIDIA CEOのジ...
2023 年の ACM フェローが発表されました。先ほど、米国計算機協会 (ACM) は、2023...
製造強国戦略の徹底的な実行の重要な部分として、ロボット産業はますます多くの人々の注目を集めています。...
[51CTO.com オリジナル記事] Huawei が成都の開発者に特典を提供! 2020年7月...
強化学習は、エージェントが環境と対話し、蓄積された報酬を最大化するために最適なアクションを選択する方...
Adroit Market Research によると、世界のロボットプロセス自動化技術市場は 20...