「Nvidia Triton Inference Serverを使用してPyTorchモデルをデプロイする」

Deploying PyTorch models using Nvidia Triton Inference Server

柔軟で高性能なモデルサービングソリューション

Unsplashからの画像

機械学習(ML)の価値は、モデルのホスティングと推論に到達したときに本当に認識されます。モデルがスケーリングアップおよびスケーリングダウンするのに役立つ、高性能なモデルサービングソリューションがなければ、MLワークロードを本番環境で運用することは困難です。

モデルサーバーとは何ですか/モデルサービングとは何ですか? モデルサーバーは、MLの世界におけるウェブサーバーに相当するものです。モデルに大量のハードウェアを投入するだけでは十分ではありません。クライアントのリクエストを効率的に処理し、アプリケーションが受けているトラフィックに対応するために必要なハードウェアを適切に割り当てるための通信レイヤーが必要です。モデルサーバーはユーザーにとって調整可能な機能です。gRPC vs RESTなどの要素を制御することで、レイテンシの観点からパフォーマンスを最大化できます。人気のあるモデルサーバーの例は以下の通りです。

  • TensorFlow Serving
  • TorchServe
  • Multi-Model Server (MMS)
  • Deep Java Library (DJL)

今日私たちが探求するのはNvidia Triton Inference Serverです。高度に柔軟かつ高性能なモデルサービングソリューションです。各モデルサーバーは、モデルアーティファクトと推論スクリプトが、それ自体が理解できる独自の方法で提示される必要があります。本記事では、サンプルのPyTorchモデルを取り上げ、Triton Inference Serverを利用してホストする方法を示します。

注意:この記事では、機械学習の基本的な理解があり、モデルの構築についての理論には触れません。Pythonの習熟度とDockerコンテナの基本的な理解も前提としています。また、開発にはSageMaker Classic Notebook Instanceで作業するため、必要に応じてAWSアカウントを作成してください(他の場所でもこのサンプルを実行することもできます)。

免責事項:私はAWSの機械学習アーキテクトであり、私の意見は私自身のものです。

なぜTriton Inference Serverなのか?

Triton Inference Serverは、次のようなさまざまな利点を持つオープンソースのモデルサービングソリューションです。

  1. フレームワークのサポート:Tritonは、ネイティブで多数の…

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

人工知能

エンテラソリューションズの創設者兼CEO、スティーブン・デアンジェリス- インタビューシリーズ

スティーブン・デアンジェリスは、エンタラソリューションズの創設者兼CEOであり、自律的な意思決定科学(ADS®)技術を用いて...

人工知能

ギル・ジェロン、Orca SecurityのCEO&共同創設者-インタビューシリーズ

ギル・ゲロンは、オルカ・セキュリティのCEO兼共同設立者ですギルは20年以上にわたりサイバーセキュリティ製品をリードし、提...

人工知能

「Kognitosの創設者兼CEO、ビニー・ギル- インタビューシリーズ」

ビニー・ギルは、複数の役職と企業を横断する多様で幅広い業務経験を持っていますビニーは現在、Kognitosの創設者兼CEOであり...

データサイエンス

「2023年にデータサイエンスFAANGの仕事をゲットする方法は?」

データサイエンスは非常に求められる分野となり、FAANG(Facebook、Amazon、Apple、Netflix、Google)企業での就職は大きな成...

データサイエンス

アステラソフトウェアのCOO、ジェイ・ミシュラ - インタビューシリーズ

ジェイ・ミシュラは、急速に成長しているエンタープライズ向けデータソリューションの提供企業であるAstera Softwareの最高執...

機械学習

「機械学習 vs AI vs ディープラーニング vs ニューラルネットワーク:違いは何ですか?」

テクノロジーの急速な進化は、ビジネスが効率化のために洗練されたアルゴリズムにますます頼ることで、私たちの日常生活を形...