GPT-3.5 の微調整には非常にコストがかかることはよく知られています。この論文では、手動で微調整されたモデルが、わずかなコストで GPT-3.5 のパフォーマンスに近づくことができるかどうかを実験的に検証します。興味深いことに、この記事はまさにそれを行っています。 この論文では、SQL タスクと機能表現タスクの結果を比較して、次のことがわかりました。
この実験の結論の 1 つは、GPT-3.5 の微調整は初期検証作業には適しているが、その後は Llama 2 のようなモデルが最適な選択肢になる可能性があるということです。簡単にまとめると、
次に、この記事がどのように実装されているかを見てみましょう。 下の図は、SQL タスクと機能表現タスクで収束するようにトレーニングされた Code Llama 34B と GPT-3.5 のパフォーマンスを示しています。結果は、GPT-3.5 が両方のタスクで優れた精度を達成することを示しています。 ハードウェアの使用に関しては、実験では A40 GPU が使用され、1 時間あたり約 0.475 ドルのコストがかかりました。 さらに、この実験では、Spider データセットのサブセットと Viggo 機能表現データセットという、微調整に非常に適した 2 つのデータセットが選択されました。 GPT-3.5 モデルと公平に比較するために、Llama は最小限のハイパーパラメータの微調整を受けました。 私たちの実験における 2 つの重要な選択は、完全なパラメータの微調整ではなく、Code Llama 34B と Lora の微調整を使用することです。 実験は、Lora ハイパーパラメータの微調整に関するルールにほぼ従いました。Lora アダプターは次のように構成されました。 次に、SQL ヒントの例を示します。 SQLプロンプトは部分的に表示されています。完全なプロンプトについては元のブログを参照してください。 この実験では完全なSpiderデータセットは使用しなかった。 この実験では、sql-create-context データセットと Spider データセットの交差部分を使用することを選択します。モデルに提供されるコンテキストは、次のような SQL 作成コマンドです。 SQL タスク コードとデータ アドレス: https://github.com/samlhuillier/spider-sql-finetune 機能表現のヒントの例を以下に示します。 機能表現のヒントは部分的に表示されています。完全なヒントについては元のブログをご覧ください。 出力は次のようになります。 評価フェーズでは、2 つの実験はすぐに収束しました。 機能表現タスクコードとデータアドレス: https://github.com/samlhuillier/viggo-finetune 詳細については、元のブログをご覧ください。 |
<<: OpenAIは静かにその中核となる価値観を改訂し、汎用人工知能の構築に注力する
1. 畳み込みニューラルネットワーク畳み込みニューラル ネットワーク (CNN) は、人工ニューロン...
データ駆動型進化的最適化とは何ですか? それは単なるデータ + 最適化アルゴリズムですか? データ駆...
AI は問題解決に新たな次元をもたらし、さまざまな業界の企業に利益をもたらします。 AI は、膨大な...
1. AIと機械学習を採用する人が増える人工知能 (AI) と機械学習 (ML) は単なる流行語では...
ファーウェイにとって、独自のチップを開発することは必ず進むべき道であり、さらなる発展を遂げたいのであ...
C# アルゴリズムは、バイナリ ツリーの定義、既知のバイナリ ツリーの構築方法、および C# でバイ...
さらに、2024 年までに、産業企業は自己管理テクノロジーと再設計された運用プロセスを組み合わせるこ...
[[92385]] Windows XP ユーザーは、現在の XP が 2001 年にリリースされた...
人工知能 (AI) が医療分野において大きなチャンスと潜在的なリスクを抱えていることはよく知られてい...
AIは現在ニュースでよく取り上げられています。現在、AIは医療診断、新しい化学物質の合成、群衆の中に...
ニューラルネットワークは人間の脳を模倣するために開発されました。まだ実現されていないものの、ニューラ...
編集者注: 将来は AI の時代であるため、あらゆる規模のテクノロジー企業が人材獲得を競っています。...