「転移学習の非合理的な効果」

「転移学習の非合理的な効果」

Keras Functional APIを使用したマルチ出力予測のための必須ガイド

Image by Gerd Altmann from Pixabay

複雑な深層学習ニューラルネットワークを訓練するには、かなりの計算効率、大量のデータコーパスの利用可能性、および最新の結果を達成するためのより良い特徴学習アーキテクチャが必要です。しかし、これらの要件は、スタートアップ、研究者、および学生の場合にのみ満たされることがあります。最近の深層学習の進歩により、多くの事前学習済みモデルがオープンソース化されています。

人気のある畳み込みニューラルネットワークベースの事前学習済みモデルには、VGG16/19、ResNet、MobileNet、EfficientNet、ResNeXtなどがあります。これらの事前学習済みモデルの重みとアーキテクチャを調整して、さまざまなユースケースで使用することができます。

VGG16ネットワークは、画像を入力として受け取り、多クラス予測(1000クラスのうちの1つ)を行うために使用される人気のある事前学習済みモデルです。

本記事では、Keras Functional APIを使用して複数の予測またはマルチ出力予測を行うユースケースを開発するために転移学習を活用します

問題の設定:

与えられた人物の顔の画像から、年齢、性別、民族性(マルチ出力予測)を予測するモデルを開発することです。

(Image by Author), Birds-eye illustration of the use-case

転移学習を活用し、VGG-16の事前学習済みネットワークを使用して、上記のアーキテクチャをモデリングし、マルチ出力予測を行う必要があります。残念ながら、VGGネットワークは、マルチ出力予測ではなく、マルチクラス予測(1000クラスのうちの1つ)を行うために設計されています。

解決策:

今回の課題は、Keras Functional APIを使用してVGG-16のアーキテクチャを調整して、マルチ出力予測を行うようにすることです。

データセット:

私は、23,000以上の注釈付き顔画像とそれに対応する年齢、性別、民族性を持つKaggleのデータセットを使用します(CC0ライセンスの下でオープンソース化されています)。

データの準備:

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

AIニュース

「MITのPhotoGuardは、AI画像操作に対抗するためにAIを使用します」

人工知能(AI)が進化するにつれて、ハイパーリアルな画像の生成と操作がますます利用可能になっています。生成AI技術は創造...

機械学習

人間とAIの協力

「AIと人間の知能の関係を探求する中で、最近のGenAIの出現は、その人間の知能を超越する能力について疑問を投げかけています」

データサイエンス

「データストーリーテリングとアナリティクスにおける生成AIのインパクトの公開」

導入 データ分析の広大な領域の中で、ゲネラティブ人工知能(GAI)はゲームを変える最も重要な進展の一つです。これは、歴史...

人工知能

「インテリアデザインのための中間プロンプト」

「これらのミッドジャーニーのインテリアデザインのヒントを使って、家のどの部屋でもリフレッシュしてください」

人工知能

「ビジネスを拡大するための25のChatGPTプロンプト」

「25個のChatGPTテンプレートのプロンプトをコピーして貼り付けすることで、あなたのビジネス(および収入)を次のレベルに引...