GPT-4の最強代替アップデート！カリフォルニア大学バークレー校がVicuna v1.5をリリース、4Kおよび16Kコンテキストをサポート、SOTAをリフレッシュ、LeCunが賞賛を再投稿

GPT-4 の最強の代替品が更新されました!

今回、カリフォルニア大学バークレー校は、最新の Llama 2 をベースに、Vicuna v1.5 の更新バージョンをリリースしました。

4K および 16K コンテキストをサポートするだけでなく、ほぼすべてのベンチマークで SOTA を達成します。

3 月のリリース以来、Vicuna は最も人気のあるチャット LLM の 1 つになりました。マルチモダリティ、AI の安全性、評価に関する研究は画期的です。

ビクーニャのモデルは、先月、Hugging Face で 200 万回以上ダウンロードされました。

LeCun 氏は、独自のモデルに基づいた Vicuna の新バージョンも発表しました。

Vicunaによる素晴らしいプロジェクト

ミニGPT4

アドレス: https://minigpt-4.github.io

高度な大規模言語モデル Vicuna を使用して微調整された、MiniGPT-4 用の新しいモデル。

テキスト予測ではChatGPTの90%を達成できます。視覚認識に関しては、研究者らは BLIP-2 と同じ事前トレーニング済みの視覚コンポーネントも使用しました。

コンポーネントは、EVA-CLIP の ViT-G/14 と Q-Former で構成されています。

MiniGPT-4 は、エンコードされた視覚的特徴を Vicuna 言語モデルに合わせるためのマッピングレイヤーのみを追加し、すべての視覚的および言語コンポーネントパラメータを固定します。

ラヴァ

アドレス: https://llava-vl.github.io

LLaVA は、ウィスコンシン大学マディソン校、マイクロソフト、コロンビア大学の研究者によってリリースされた大規模なマルチモーダルモデルです。

このモデルは、一般的な視覚と言語理解のために、ビジュアルエンコーダーとビクーニャを組み合わせています。

その機能は GPT-4 の画像およびテキスト理解機能に近いもので、GPT-4 と比較して 85.1% の相対スコアを達成し、科学的 QA における現在最も高度な精度を実現しています。

LLM攻撃

アドレス: https://llm-attacks.org

CMU と AI 安全センターの研究者は、一連の特定の意味のないトークンを追加することで、謎のプロンプトサフィックスを生成できることを発見しました。

その結果、誰でも簡単に LLM のセキュリティ対策を破り、無制限の量の有害コンテンツを生成できるようになります。

興味深いことに、この「敵対的攻撃」の方法は、オープンソースシステムのガードレールを突破するだけでなく、ChatGPT、Bard、Claude などのクローズドソースシステムも回避できます。

ゴリラ

アドレス: https://github.com/ShishirPatil/gorilla

Gorilla は、適切な API 呼び出しを生成できる LLaMA アーキテクチャに基づく大規模な言語モデルです。

これは、Torch Hub、TensorFlow Hub、HuggingFace という 3 つの大規模な機械学習ライブラリのデータセットでトレーニングされました。

Gorilla は、Kubernetes、GCP、AWS、OpenAPI などの新しいドメイン知識を迅速に追加することもできます。

ゼロショットのシナリオでは、Gorilla は GPT-4、ChatGPT、Claude などのモデルよりも優れています。

量子ロラ

アドレス: https://github.com/artidoro/qlora

ワシントン大学の研究者らは、モデルのパフォーマンスを損なうことなく量子化された 4 ビットモデルを微調整できることを初めて実証しました。

彼らの新しい方法である QLoRA は、新しい高精度技術を使用して、事前トレーニング済みのモデルを 4 ビットに量子化し、学習可能な低ランクのアダプター重みの小さなセットを追加します。

これらのアダプタの重みは、量子化された重みの勾配を逆伝播することによって調整されます。

QLoRA メソッドは、4 ビットの量子化モデルも効果的に微調整して、フル精度モデルに匹敵するパフォーマンスを実現できることを示しています。

ツールラマ

アドレス: https://github.com/OpenBMB/ToolBench

ToolLLM プロジェクトの目的は、一般的なツール使用機能を備えた強力な言語モデルの構築を容易にするために、オープンソースで大規模かつ高品質の命令チューニング SFT データセットを構築することです。

研究者らによると、オープンソースの LLM は何千もの異なる現実世界の API を習得することができ、これは高品質の命令調整データセットを収集することによって実現されるという。

<<: 老黄が勝利！ Nvidia H100の注文は24年待ち、マスク氏も黙っていられない

>>:

AI は今後 10 年間で BAT のリセットボタンとなるでしょうか?

ブログ

エッジにAIを導入する3つのメリット

ブログ

CoCoPIE 主任科学者との対話: AI は審判になれるが、ショーを乗っ取ることはできない | T Frontline

ブログ

ベルギー国会議員は、携帯電話を使用しているとAIによって公に名指しされたため、議会で「気を散らされる」ことはできなくなった。

ブログ

ディープラーニングの次に来るものは何でしょうか?

ブログ

AIが写真を見て場所を推測、その精度は90%以上！スタンフォードの最新のPIGEONモデル：予測誤差の40％は25キロメートル未満

ブログ

Googleとハーバード大学がこれまでで最も複雑な3D脳マップを作成

ブログ

GPT-4の最強代替アップデート！カリフォルニア大学バークレー校がVicuna v1.5をリリース、4Kおよび16Kコンテキストをサポート、SOTAをリフレッシュ、LeCunが賞賛を再投稿

最新モデルの重量

Vicunaによる素晴らしいプロジェクト

AI は今後 10 年間で BAT のリセットボタンとなるでしょうか?

エッジにAIを導入する3つのメリット

CoCoPIE 主任科学者との対話: AI は審判になれるが、ショーを乗っ取ることはできない | T Frontline

ベルギー国会議員は、携帯電話を使用しているとAIによって公に名指しされたため、議会で「気を散らされる」ことはできなくなった。

ディープラーニングの次に来るものは何でしょうか?

AIが写真を見て場所を推測、その精度は90%以上！スタンフォードの最新のPIGEONモデル：予測誤差の40％は25キロメートル未満

Googleとハーバード大学がこれまでで最も複雑な3D脳マップを作成

推薦する

オープンソース | AREX: Ctrip の次世代自動回帰テストツールの設計と実装

AI、IoT、5Gの先進技術の背後にあるもの

大型模型シリーズ - RAGの解釈

AIと機械学習をサイバーセキュリティに組み込む方法

Baiduカスタマイズ画像オープンプラットフォームのトレーニングと評価

メタは触覚手袋を開発し、メタバースで猫を撫でたい人もいれば、大胆なアイデアを持つ人もいる

人工知能はサイバー犯罪をより容易かつ頻繁にしている、と研究が指摘

Facebookは人工知能を使ってコンテンツレビューの優先順位を決める

8x7B オープンソース MoE が Llama 2 に勝ち、GPT-4 に迫る!欧州版OpenAIがAI界に衝撃を与え、22人の企業が半年で20億ドルの評価額を獲得

GPT-4 はタイプ I の性格を持っていることが判明しました。ビッグモデルMBTIテストがByteから登場

Linux カーネルのメモリ管理アルゴリズム Buddy と Slab