任意のデータセットに基づいて LLM (大規模言語モデル) ロボットを作成する

任意のデータセットに基づいて LLM (大規模言語モデル) ロボットを作成する

今日、偶然Embedchainというウェアハウスを見つけ、とても便利だと思ったので、皆さんとシェアします。倉庫の住所は以下の通りです。

埋め込みチェーン

OpenAI をベースにしていますが、独自のデータセットを追加して会話型ロボットを生成することもできます。使い方は簡単で、簡単に始めることができます。

Embedchainの紹介

Embedchain は、あらゆるデータセットに基づいて LLM (大規模言語モデル) ボットを簡単に作成できるフレームワークです。データセットの読み込み、チャンク化、埋め込みベクトルの作成、ベクトル データベースへの保存というプロセス全体を抽象化します。 .add 関数と .add_local 関数を使用して 1 つまたは複数のデータセットを追加し、.query 関数を使用して追加したデータセットから回答を見つけることができます。

あなたが偉大な人物、Naval Ravikant を尊敬していて、彼の知識を会話型ロボットに変えたいと考えているとします。彼の YouTube 動画、PDF 書籍、ブログ投稿、およびあなたが提供する質問と回答のペアを Embedchain に追加すると、Embedchain がロボットを作成します。次に例を示します。

 from embedchain import App naval_chat_bot = App() # 嵌入在线资源naval_chat_bot.add("youtube_video", "https://www.youtube.com/watch?v=3qHkcs3kG44") naval_chat_bot.add("pdf_file", "https://navalmanack.s3.amazonaws.com/Eric-Jorgenson_The-Almanack-of-Naval-Ravikant_Final.pdf") naval_chat_bot.add("web_page", "https://nav.al/feedback") naval_chat_bot.add("web_page", "https://nav.al/agi") # 嵌入本地资源naval_chat_bot.add_local("qna_pair", ("Who is Naval Ravikant?", "Naval Ravikant is an Indian-American entrepreneur and investor.")) naval_chat_bot.query("What unique capacity does Naval argue humans possess when it comes to understanding explanations or concepts?") # 答案:Naval 认为,人类在理解解释或概念方面拥有独特的能力,这是在这个物理现实中可能的最大程度。

Embedchainの使用

Embedchain の使用を開始するには、まずパッケージがインストールされていることを確認してください。まだインストールされていない場合は、pip を使用してインストールできます。

 pip install embedchain

Embedchain は OpenAI の埋め込みモデルを使用してブロックの埋め込みを作成し、ChatGPT API を LLM として使用して、関連ドキュメントへの回答を提供します。 OpenAI アカウントと API キーがあることを確認してください。 APIキーをお持ちでない場合は、このリンク[1]にアクセスして作成できます。

APIキーを取得したら、OPENAI_API_KEYという環境変数に設定します。

 import os os.environ["OPENAI_API_KEY"] = "sk-xxxx"

次に、embedchain から App クラスをインポートし、.add 関数を使用してデータセットを追加します。

 from embedchain import App naval_chat_bot = App() # 嵌入在线资源naval_chat_bot.add("youtube_video", "https://www.youtube.com/watch?v=3qHkcs3kG44") naval_chat_bot.add("pdf_file", "https://navalmanack.s3.amazonaws.com/Eric-Jorgenson_The-Almanack-of-Naval-Ravikant_Final.pdf") naval_chat_bot.add("web_page", "https://nav.al/feedback") naval_chat_bot.add("web_page", "https://nav.al/agi") # 嵌入本地资源naval_chat_bot.add_local("qna_pair", ("Who is Naval Ravikant?", "Naval Ravikant is an Indian-American entrepreneur and investor."))

スクリプトまたはアプリにアプリの他のインスタンスがある場合は、次のようにインポートを変更できます。

 from embedchain import App as EmbedChainApp # 或者from embedchain import App as ECApp

これでアプリケーションが作成されました。 .query 関数を使用すると、任意のクエリに対する回答を取得できます。

 print(naval_chat_bot.query("What unique capacity does Naval argue humans possess when it comes to understanding explanations or concepts?")) # answer: Naval argues that humans possess the unique capacity to understand explanations or concepts to the maximum extent possible in this physical reality.

サポートされている形式

以下の形式がサポートされています:

Youtubeビデオ

アプリケーションに Youtube ビデオを追加するには、データ型 (.add の最初のパラメーター) として youtube_video を使用します。例えば:

 app.add('youtube_video', 'a_valid_youtube_url_here')

PDFファイル

PDF ファイルを追加するには、データ型 pdf_file を使用します。例えば:

 app.add('pdf_file', 'a_valid_url_where_pdf_file_can_be_accessed')

パスワードで保護された PDF はサポートされていないことに注意してください。

ウェブページ

任意の Web ページを追加するには、データ型 web_page を使用します。例えば:

 app.add('web_page', 'a_valid_web_page_url')

文章

独自のテキストを指定するには、データ型テキストを使用して文字列を入力します。テキストは処理されず、非常に多様になる可能性があります。例えば:

 app.add_local('text', 'Seek wealth, not money or status. Wealth is having assets that earn while you sleep. Money is how we transfer time and wealth. Status is your place in the social hierarchy.')

注: ほとんどの場合、段落全体またはファイル全体を提供するため、例ではこれは使用されません。

<<:  Dubbo 負荷分散戦略コンシステントハッシュ

>>:  貧困が私を訓練した

ブログ    
ブログ    

推薦する

GoogleのReCaptchaシステムが破られ、機械音声認証の精度は85%に達した

米国のメリーランド大学の研究者4人が、GoogleのキャプチャシステムReCaptchaを解読できる...

アマゾンが注文梱包ロボットを導入、数千人の従業員が職を失う可能性も

アマゾンの従業員2人によると、同社は近年、いくつかの倉庫で数々の新技術を導入し始めており、その中には...

DeepMindの創設者はチューリングテストを覆したい!外国人男性がAIを使って90日間で3万ドルを稼いだ

チューリングテストは時代遅れですか? DeepMind の創設者 Mustafa Suleyman ...

産業用ロボットのプログラミングにはどの言語が使用されますか?

多くの友人から、産業用ロボットのプログラミングにはどの言語が使用されるのかと尋ねられました。今回は、...

MySQLインデックスの背後にあるデータ構造とアルゴリズムの原理

序文プログラミングの分野では、「プログラム = データ構造 + アルゴリズム」というよく知られたルー...

トレンドマイクロ:2030年までにAIがサイバーセキュリティ担当者に取って代わる

トレンドマイクロは、2021年に向けて、サイバー犯罪者がホームネットワークを利用して企業のITおよび...

複数の LLM が連携して機能します。清華大学などがオープンソースのマルチエージェントフレームワークAgentVerseを開発:Minecraftのアイテムを共同で作成し、ポケモンを訓練

人類が地球上の食物連鎖の頂点に上り詰め、さらには宇宙の探査を続けられるようになったのは、個人の脳だけ...

人工知能技術が身元調査業界に革命を起こしている

これは、AI テクノロジーが身元調査業界に革命をもたらし、これまで以上に効率的でコスト効率の高いソリ...

AIを安全で信頼できるものにするためには、まずアルゴリズムの一般化能力を理解することから始める

ディープラーニング システムは、新しいデータに対してどの程度のパフォーマンス (一般化) を発揮しま...

戦争における顔認識:フランスの諜報機関がチェチェン兵士の身元を発掘、ウクライナは捕虜の身元確認に利用

ビッグデータダイジェスト制作ロシアとウクライナの紛争が始まると、カディロフ・ジュニアはチェチェンの首...

組み込みアルゴリズム CRCチェックアルゴリズム

[[350334]]データ伝送中にエラーが発生することは避けられません。データを受信した後、受信側は...

TensorFlow の基礎から実践まで: 交通標識分類ニューラル ネットワークの作成方法を段階的に学習します

[[198754]] TensorFlow は、最も人気のあるディープラーニングフレームワークになり...

ヘルスケア市場におけるサービスロボットは2027年までに32億ドルに達すると予想

[[434302]]ヘルスケア分野におけるロボットへの投資の増加が、医療サービスロボットの開発を促進...

...