大規模な言語モデルを効率的に提供するためのフレームワーク

言語モデルの効率的な提供のためのフレームワーク

大規模言語モデルをOpenAI APIを使用するかのように無料で提供する方法

Austrian National Libraryによる写真(Unsplash)

はじめに

ここ数ヶ月、大規模言語モデルの使用について多くの関心が寄せられています。これは、解決が困難と思われるほとんどのユースケースに取り組む能力と、素晴らしい研究コミュニティのおかげです。

AIや機械学習モデルも、いかに強力であっても、本番環境に移行しなければステークホルダーがより良い意思決定をするのには役立ちません。

これらの大規模言語モデルを展開することは、展開チームが無能であるわけではなく、単にこの種のモデルの展開の複雑さのために、間違いなく最も困難なタスクの一つです。

これらのモデルの産業化プロセスをできるだけスムーズにするフレームワークがあれば素晴らしいですよね?

そこで、UCバークレーがApacheライセンスの下で開発したオープンソースライブラリであるvLLMライブラリが役立ちます。

vLLMの背後にある考え方は、大規模言語モデルのサービングと推論を、産業界と小規模研究チームの両方に手頃な価格で提供することです。

この非スポンサー(非プロモーション)のチュートリアルを完了すると、次のことができるようになります:

  • ワークスペースとGoogle ColabにvLLMをセットアップする
  • プロンプト上で大規模言語モデルのオフラインバッチ推論を実行する
  • Postmanおよびcurlコマンドを使用してモデルを提供するAPIサーバーを作成する

vLLM — なぜ気にすべきか?

実装に入る前に、vLLMのパフォーマンスをHuggingFace Transformers(HF)などの他のツールと比較して簡単に概観しましょう。

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

データサイエンス

「データストーリーテリングとアナリティクスにおける生成AIのインパクトの公開」

導入 データ分析の広大な領域の中で、ゲネラティブ人工知能(GAI)はゲームを変える最も重要な進展の一つです。これは、歴史...

データサイエンス

Deep Learningモデルのトレーニングをスーパーチャージ

90%に到達すると精度が初めのほうでは簡単に向上しますが、それ以上の改善を得るためには非常に力を入れなければならないとい...

データサイエンス

『FastSpeech:論文の概要と実装』

2019年、FastSpeechはニューラルテキスト音声変換のフロンティアを推し進め、推論速度を大幅に改善しながら、単語の繰り返し...

AIニュース

「Google.orgの新しい助成金は、永久凍土の融解を追跡するのに役立ちます」

新たな500万ドルの助成金は、Woodwell Climate Research Centerが北極の永久凍土の解凍をほぼリアルタイムで追跡するのを支援...

データサイエンス

スタンフォードの研究者たちは、基礎流体力学のための初の大規模な機械学習データセットであるBLASTNetを紹介しました

スタンフォードの研究者たちは、BLASTNetという画期的な開発を紹介し、計算流体力学(CFD)の新たな時代の到来を予感させまし...

AI研究

サリー大学の研究者が新しい人工知能(AI)モデルを開発しましたこのモデルは、通信ネットワークが最大76%ものネットワークを節約できる可能性があります

オープン・ラジオ・アクセス・ネットワーク(O-RAN)は、分離されたラジオ・アクセス・ネットワーク(RAN)に知能を注入し、...