「検索補完生成を用いてより能力の高いLLMを構築する」

Building a more capable LLM using search completion generation.

リトリーバル増強生成による知識ベースの統合により、LLMを強化する方法

Image by author: Generated with Midjourney — 著者による画像: Midjourneyで生成されたもの

ChatGPTの制約事項

コード生成以外の実用的なビジネスユースケースでは、ChatGPTには制約があります。この制約は、トレーニングデータとモデルの幻覚傾向から生じます。執筆時点では、Chat-GPTに2021年9月以降のイベントに関する質問をすると、おそらく次のような回答が返ってきます：

これは役に立たないので、どのように修正すればよいでしょうか？

オプション1 – 最新のデータでモデルをトレーニングまたはファインチューニングする。

モデルのファインチューニングやトレーニングは実用的ではなく、高額です。コストを置いておいても、データセットを準備するために必要な努力はこのオプションを選ばない理由となります。

オプション2 – リトリーバル増強生成（RAG）メソッドの使用。

RAGメソッドを使用することで、大規模言語モデルに最新の知識ベースへのアクセス権を与えることができます。これは、モデルをゼロからトレーニングするかファインチューニングするよりもはるかに安価で、実装も簡単です。この記事では、OpenAIモデルとRAGを利用する方法を紹介します。Wikipediaの知識ベースから2022年のロシア・ウクライナ紛争に関する質問に対するモデルの能力を短い分析を行うことで試してみます。

注意：このトピックは敏感なものですが、現在のChatGPTモデルには関連知識がないため、選ばれました。

ライブラリと前提条件

OpenAIのAPIキーが必要です。直接ウェブサイトから取得するか、このチュートリアルに従ってください。RAGに使用されるフレームワークはDeepsetのHaystackで、オープンソースです。彼らは大規模言語モデルの上でアプリケーションを構築するためのAPIを提供しています。また、Hugging Faceのsentence transformersとtransformersライブラリも利用しています。

文の埋め込みはモデルがテキストを解釈するのに役立ちます

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Was this article helpful?

93 out of 132 found this helpful

「検索補完生成を用いてより能力の高いLLMを構築する」

リトリーバル増強生成による知識ベースの統合により、LLMを強化する方法

ChatGPTの制約事項

ライブラリと前提条件

文の埋め込みはモデルがテキストを解釈するのに役立ちます

Was this article helpful?

XGBoost 最終ガイド（パート1）

マシンラーニングエンジニアは、実際に何をしているのでしょうか？

人工知能

「3つの質問：ロボットの認識とマッピングの研磨」

2023年にAmazonのデータサイエンティストになる方法は？

「ゲイリー・ヒュースティス、パワーハウスフォレンジクスのオーナー兼ディレクター- インタビューシリーズ」

「Kognitosの創設者兼CEO、ビニー・ギル- インタビューシリーズ」

「UVeyeの共同設立者兼CEO、アミール・ヘヴェルについてのインタビューシリーズ」

「トリントの創設者兼CEO、ジェフ・コフマンへのインタビューシリーズ」