Google の最新のオープンソース Gemma モデルが Llma-2 を数秒で上回りました。

Google の最新のオープンソース Gemma モデルが Llma-2 を数秒で上回りました。

ジェマとは

ジェマ 軽量で最先端のオープンモデルシリーズで、  ジェミニ 同じ研究と技術をモデル化します。 Google DeepMind と Google の他のチームによって開発された Gemma は、ふたご座にヒントを得たもので、その名前は「宝石」を意味するラテン語の gemma を反映しています。 Google は、モデルの重み付けのリリースに合わせて、開発者のイノベーションをサポートし、コラボレーションを促進し、Gemma モデルの責任ある使用をガイドするための関連ツールもリリースします。

知っておくべき重要な詳細は次のとおりです。

  • モデルウェイトには、Gemma 2B と Gemma 7B の 2 つのサイズがあります。事前トレーニング済みおよび命令調整済みのバリアントが各サイズごとにリリースされます。
  • 新しい「Responsible Generative AI Toolkit」は、Gemma を使用してより安全な AI アプリケーションを作成するためのガイダンスと基本ツールを提供します。
  • すべての主要フレームワーク (JAX、PyTorch、TensorFlow) およびネイティブの Keras 3.0 の推論と教師あり微調整 (SFT) 用のツールチェーンが提供されます。
  • すぐに使用できる Colab および Kaggle ノートブック、および Hugging Face、MaxText、NVIDIA NeMo、TensorRT-LLM などの一般的なツールとの統合により、Gemma を簡単に使い始めることができます。
  • 事前トレーニング済みで命令調整済みの Gemma モデルは、ノートパソコン、ワークステーション、または Google Cloud で実行でき、Vertex AI および Google Kubernetes Engine(GKE)に簡単にデプロイできます。
  • NVIDIA™ (NVIDIA®) GPU や Google Cloud TPU など、複数の AI ハードウェア プラットフォームにわたる最適化により、業界をリードするパフォーマンスが保証されます。
  • 利用規約は、責任ある商業的使用および配布を許可します。

Gemma モデルは、現在市場で最大かつ最も強力な AI モデルである Gemini とテクノロジーおよびインフラストラクチャ コンポーネントを共有しています。これにより、Gemma 2B および 7B は、他のオープン モデルと比較して、その規模でクラス最高のパフォーマンスを実現できます。さらに、Gemma モデルは開発者のラップトップまたはデスクトップ コンピューターで直接実行できます。驚くべきことに、Gemma は主要なベンチマークで大型モデルを上回り、安全性と責任ある出力に関する厳しい基準も満たしています。

上図の評価データから判断すると、Gemma 7Bモデルの性能はすでに同レベルのLlma-2 7Bよりも優れており、Llama-2 13Bも完全に上回っています。次回は、ジェマの最新モデルをいち早く体験する方法を紹介します。

オラマがジェマを運営

まず、コンピュータにollama [1]がインストールされていることを確認してください。まだインストールしていない場合は、「わずか数分で大規模なローカル言語モデルをデプロイ!」という記事を参照してください。

ollama を正常にインストールしたら、コマンド ラインに次のコマンドを入力して、Gemma 2b または Gemma 7b モデルを実行できます。

 ollama run gemma:2b # Or ollama run gemma:7b

このコマンドを実行すると、Gemma 2B または Gemma 7B モデルが自動的にダウンロードされます。コンピュータに十分なメモリがある場合は、次のコマンドを使用して、量子化されていないバージョン、つまり精度の高いバージョンをインストールし、より良い結果を得ることができます。

 ollama run gemma:2b-instruct-fp16 # Or ollama run gemma:7b-instruct-fp16

ollamaに加えて、 llama.cpp [2]も使用できます。  またはgemma.cpp [3]  ジェマを体験しに来てください。

llama.cpp Gemma を実行する

ソース: https://github.com/ggerganov/llama.cpp/pull/5631

gemma.cpp Gemmaを実行する

ソース: https://github.com/google/gemma.cpp

この記事では、Google の最新の Gemma オープンソース モデルを体験する 3 つの方法を紹介します。興味のある方は、このモデルの効果を体験してください。

参考文献

[1]オラマ:   https://ollama.com/

[2]llama.cpp:   https://github.com/ggerganov/llama.cpp

[3] gemma.cpp:   https://github.com/google/gemma.cpp


<<:  Karpathy が OpenAI を離れ、2 時間の AI コースを開始! GPTトークナイザーをゼロから構築する

>>:  モデル融合、ハイブリッド専門家、小規模LLM、2024年のLLMの発展方向を理解するためのいくつかの論文

ブログ    
ブログ    

推薦する

...

人工知能が雪の結晶をリアルタイムで捉え、約700人の足跡を追跡可能に

2月4日の北京冬季オリンピックの開会式で、若い俳優たちが「平和の鳩」を手に持ち、彼らが動くと、足元に...

...

年末大特集!2020年に最も注目されたAI論文をまとめて紹介

2020年、新型コロナウイルスのせいで世界中の人々が恐怖におののいていることでしょう…しかし、これは...

ついに、人工知能の3つの重要な機能を説明する人がいた。

人間の知性は広大かつ複雑です。人間の成果の中には、今日の機械では到底達成できないものもあり、機械がこ...

データサイエンスについて知っておくべきこと: 10 の重要な概念 + 22 のグラフ

01 バイアスと分散のトレードオフこれは、機械学習における最も重要な理論の中で常に上位にランクされ...

...

コンピュータービジョンとは何ですか?

映画『マトリックス リザレクション』(2021年)では、主人公のネオがコンピューター生成の世界「マト...

人工知能は裁判所によって特許発明者とみなされるでしょうか?

人工知能(AI)は、新薬の発見から新しい数学の問題の解決まで、あらゆることを人間が行うのに役立ってお...

...

2025年までに音声認識市場は267億9000万ドルに達する

3月29日、市場調査会社Meticulous Market Researchが発表した最新のレポート...

AI、ブロックチェーン、ロボット:テクノロジーは仕事の未来をどのように変えるのでしょうか?

編集者注:人工知能、ブロックチェーン、ロボットなどの破壊的な新技術が継続的に発展する中、人々はそれら...

AIはDevOpsエクスペリエンスに目に見える以上の変化をもたらす

Cycode の共同創設者兼 CTO である Ronen Slavin 氏は、AI によって実現され...

XiaoIce 技術担当副社長、周 立氏: AI 対話がメタバースの新たな未来を切り開く

ゲスト: 周 麗編集者: Qianshan人間とコンピュータの対話は長い間私たちの日常生活に組み込ま...