大規模な言語モデルを効率的に提供するためのフレームワーク

言語モデルの効率的な提供のためのフレームワーク

大規模言語モデルをOpenAI APIを使用するかのように無料で提供する方法

Austrian National Libraryによる写真(Unsplash)

はじめに

ここ数ヶ月、大規模言語モデルの使用について多くの関心が寄せられています。これは、解決が困難と思われるほとんどのユースケースに取り組む能力と、素晴らしい研究コミュニティのおかげです。

AIや機械学習モデルも、いかに強力であっても、本番環境に移行しなければステークホルダーがより良い意思決定をするのには役立ちません。

これらの大規模言語モデルを展開することは、展開チームが無能であるわけではなく、単にこの種のモデルの展開の複雑さのために、間違いなく最も困難なタスクの一つです。

これらのモデルの産業化プロセスをできるだけスムーズにするフレームワークがあれば素晴らしいですよね?

そこで、UCバークレーがApacheライセンスの下で開発したオープンソースライブラリであるvLLMライブラリが役立ちます。

vLLMの背後にある考え方は、大規模言語モデルのサービングと推論を、産業界と小規模研究チームの両方に手頃な価格で提供することです。

この非スポンサー(非プロモーション)のチュートリアルを完了すると、次のことができるようになります:

  • ワークスペースとGoogle ColabにvLLMをセットアップする
  • プロンプト上で大規模言語モデルのオフラインバッチ推論を実行する
  • Postmanおよびcurlコマンドを使用してモデルを提供するAPIサーバーを作成する

vLLM — なぜ気にすべきか?

実装に入る前に、vLLMのパフォーマンスをHuggingFace Transformers(HF)などの他のツールと比較して簡単に概観しましょう。

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

機械学習

「AIアクトの解読」

AI法 [1]は、長く苦痛な過程を経て形成されましたこれは、ヨーロッパの立法プロセスにおける政治の影響と重要性を完璧に示す...

機械学習

アクセラレータの加速化:科学者がGPUとAIでCERNのHPCを高速化

注:これは、高性能コンピューティングを利用した科学を前進させる研究者のシリーズの一環です。 Maria Gironeは、高速コンピ...

機械学習

AIの時代のコーディング:ChatGPTの役割と次世代プログラミング

ChatGPTはデジタルの世界を変えつつあり、プログラミングも例外ではありませんプログラマーにどのように助けられ、コーディン...

データサイエンス

データを持っていますか?SMOTEとGANが合成データを作成する方法

合成データは、開発者やデータサイエンティストにとって大きな課題であるAI/MLモデルの訓練に十分でクリーンなデータを持つこ...

データサイエンス

公正を実現する:生成モデルにおけるバイアスの認識と解消

2021年、プリンストン大学の情報技術政策センターは、機械学習アルゴリズムが人間と同様の偏見を抱くことがあるという報告書...