GenAIがより良い回答を提供するためのヒント

GenAIがより良い回答を提供するためのヒント

GenAI は、ユーザーが独自の方法でデータをクエリし、ニーズに合わせた回答を受け取ることができるインターフェースとして大きな可能性を秘めています。たとえば、クエリ アシスタントとして、GenAI ツールは、シンプルな質疑応答形式を使用して、顧客が広範な製品ナレッジ ベースをより適切にナビゲートできるように支援できます。

しかし、GenAI を使用してデータに関する質問に答える前に、まず質問の内容を評価することが重要です。

これは、Miso.ai の CEO 兼共同創設者である Lucky Gunasekara 氏が、現在 GenAI ツールを開発しているチームに与えたアドバイスです。

Miso.ai の製品である Smart Answers がどのように洞察力を発揮するかに興味があったので、私は Gunasekara 氏に、ユーザーの質問を理解して回答する Miso.ai のアプローチについてさらに詳しく話してもらいました。

大規模言語モデルは「実は私たちが考えていたよりもはるかに単純です」とグナセカラ氏は言う。例えば、強い意見を問われた場合、大規模言語モデルは、既存のデータがその意見が間違っていることを示唆しているとしても、その意見を裏付ける慎重に選択されたデータを探す可能性が高い。したがって、「プロジェクト X はなぜ失敗したのか」と尋ねられた場合、大規模な言語モデルは、たとえプロジェクトが成功したとしても、プロジェクトが失敗した理由の長いリストを吐き出す可能性があります。これは、一般向けアプリケーションに期待される動作ではありません。

グナセカラ氏は、質問を評価することは、大規模な言語モデルを特定のデータ群に向け、そのデータのみに基づいて質問に答えるよう指示する、いわゆる RAG (検索拡張生成) アプリケーションで見落とされがちなステップであると指摘した。

このようなアプリケーションは通常、次の (少し簡略化された) セットアップ パターンに従います。

  • すべてのデータが大きすぎて単一の大きな言語モデルクエリに収まらないため、既存のデータをチャンクに分割します。
  • 各ブロックに対して、そのブロックのセマンティクスを数字の文字列として表すいわゆる埋め込みが生成され、保存され、データが変更されたときに必要に応じて更新されます。

次に各質問について:

  • 埋め込みを生成します。
  • 埋め込みベースの計算を使用して、質問に意味的に最も類似するテキストのチャンクを見つけます。
  • ユーザーの質問を大規模な言語モデルに入力し、最も関連性の高いチャンクのみに基づいて回答するように指示します。

ここで、グナセカラ氏のチームは異なるアプローチを採用し、関連情報を検索する前に質問を調べる手順を追加しました。 「この質問を直接尋ねるのではなく、まずその仮定が正しいかどうかを尋ねます」と、Miso の CTO 兼共同創設者である Andy Hsieh 氏は説明します。

問題に固有の仮定を確認することに加えて、基本的な RAG パイプラインを強化して結果を改善する方法は他にもあります。 Gunasekara 氏は、特に実験段階から実稼働に適したソリューションに移行する場合は、基本を超えて取り組むことを推奨しています。

「『ベクター データベースを構築し、RAG セットアップを実行すれば、すべてがすぐに機能する』ということに重点が置かれていますが、これは概念実証には最適です。しかし、意図しない結果をもたらさないエンタープライズ グレードのサービスを実行する必要がある場合は、常にコンテキスト、コンテキスト、コンテキストが重要になります」と Gunasekara 氏は述べています。

これは、テキストの意味に加えて、最新性や人気度などの他のシグナルを使用することを意味する場合があります。グナセカラ氏は、ミソが料理ウェブサイトで取り組んでいる別のプロジェクトを挙げ、「パーティーで出すのに最適な焼き菓子は何か?」という質問を分析する。

実際に照会する必要がある信号を分離する必要がある、と彼は述べた。 「作り置き」ケーキはすぐに出す必要がないことを意味し、「パーティー用」は数人以上に出す必要があることを意味します。また、大規模な言語モデルがどのレシピが「最高」であるかをどのように判断するかという問題もあります。これは、どのレシピのトラフィックが最も多いか、どのレシピの読者ランキングが最も高いか、またはどのレシピがエディターズチョイスを受賞したかなど、他のサイトデータを使用することを意味する可能性があります。これらはすべて、関連するテキストのチャンクを見つけて集約することとは別です。

「これをうまく行うためのコツの多くは、こうした文脈上のヒントにあります」とグナセカラ氏は言う。

ビッグ言語モデルの品質も重要な要素ですが、Miso は最高評価で最も高価な商用ビッグ言語モデルを使用する必要性を感じていません。代わりに、Miso は一部のクライアント プロジェクト向けに Llama 2 ベースのモデルを微調整しています。これは、コストを抑えるためだけでなく、一部のクライアントがデータを第三者に漏らしたくないため、また Gunasekara 氏が言うところの「オープンソース ビッグ言語モデルに今、大きな勢いが生まれつつある」ためでもあります。

「オープンソースは本当に追いついています」とシェイ氏は付け加えた。「オープンソースモデルがGPT-4を上回る可能性は大いにあります。」

<<: 

>>: 

ブログ    
ブログ    
ブログ    

推薦する

海底撈のIPOは1000億元規模:将来、厨房に必要なのはエンジニア2人だけ

[[245580]] 2018年9月26日、海底撈国際ホールディングス株式会社(06862.HK)が...

我が国の人工知能市場の規模は2022年に3705億元に達すると推定されている。

人工知能は、機械を通じて人間の思考と意思決定をシミュレートすることに重点を置いたコンピューターサイエ...

AAAI 2024 フェロー発表、清華大学の朱軍教授が選出

AAAI(人工知能振興協会)は、人工知能分野で国際的に最も権威のある学術団体の一つです。フェローは協...

...

プロジェクト Digging 21 - 軽量 LLM エージェントの構築方法

8 月 12 日、Juli プロジェクト シリーズの第 21 回「大規模言語モデルのトレーニングとア...

過度な「遊び」が子どもたちのプライバシーを侵害し、自尊心を傷つける恐れがあるとして、人工知能がキャンパスに導入される

最近、香港で株式公開を準備しているAI大手のMegvii Technologyが論争を巻き起こしてい...

スマートな薬箱が登場したが、その背後にあるAIの能力を過小評価してはならない

薬を買うとき、自動販売機のように、セルフサービス機で直接注文して、必要なときにすぐに受け取ることはで...

NLP モデルは人間の言語を理解できないのでしょうか? Microsoft AdaTestはエラーの検出効率が5倍向上

自然言語処理 (NLP) モデルは人間の言語を理解できず、テキストを反対の意味として解釈しますが、こ...

近年、「人工知能」が私たちの生活に静かに登場している

科学技術と産業技術の継続的な発展により、私たちの生活は大きく向上し、「人工知能」という言葉も徐々に私...

...

人工知能産業は各地で花開いています。この7つのロボットがあなたに近づいてきます!

現在、中国の製造業、農業、飲食業、企業、機関はすべて、自動化からインテリジェンス化、デジタル化への変...

...

李開復氏、ペントランド氏と会談:AIはワンマンショーではない、AI冷戦は避けるべき

最近、Sinovation Venturesの会長兼CEOであるKai-Fu Lee博士とAlex ...