「転移学習の非合理的な効果」

「転移学習の非合理的な効果」

Keras Functional APIを使用したマルチ出力予測のための必須ガイド

Image by Gerd Altmann from Pixabay

複雑な深層学習ニューラルネットワークを訓練するには、かなりの計算効率、大量のデータコーパスの利用可能性、および最新の結果を達成するためのより良い特徴学習アーキテクチャが必要です。しかし、これらの要件は、スタートアップ、研究者、および学生の場合にのみ満たされることがあります。最近の深層学習の進歩により、多くの事前学習済みモデルがオープンソース化されています。

人気のある畳み込みニューラルネットワークベースの事前学習済みモデルには、VGG16/19、ResNet、MobileNet、EfficientNet、ResNeXtなどがあります。これらの事前学習済みモデルの重みとアーキテクチャを調整して、さまざまなユースケースで使用することができます。

VGG16ネットワークは、画像を入力として受け取り、多クラス予測(1000クラスのうちの1つ)を行うために使用される人気のある事前学習済みモデルです。

本記事では、Keras Functional APIを使用して複数の予測またはマルチ出力予測を行うユースケースを開発するために転移学習を活用します

問題の設定:

与えられた人物の顔の画像から、年齢、性別、民族性(マルチ出力予測)を予測するモデルを開発することです。

(Image by Author), Birds-eye illustration of the use-case

転移学習を活用し、VGG-16の事前学習済みネットワークを使用して、上記のアーキテクチャをモデリングし、マルチ出力予測を行う必要があります。残念ながら、VGGネットワークは、マルチ出力予測ではなく、マルチクラス予測(1000クラスのうちの1つ)を行うために設計されています。

解決策:

今回の課題は、Keras Functional APIを使用してVGG-16のアーキテクチャを調整して、マルチ出力予測を行うようにすることです。

データセット:

私は、23,000以上の注釈付き顔画像とそれに対応する年齢、性別、民族性を持つKaggleのデータセットを使用します(CC0ライセンスの下でオープンソース化されています)。

データの準備:

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

AIニュース

「AIで生成されたコードはさらにテストが必要ですか?」

「AIを搭載したツールを使用すれば、アプリケーションのプログラミングが簡単になりますしかし、人間によって書かれたコード...

人工知能

「Img2Prompt AI モデルを使用して画像をプロンプトに変換する方法:ステップバイステップガイド」

「シンプルなAPI呼び出しと少しのNode.jsで画像からプロンプトを収集します」

機械学習

カリフォルニア州での山火事との戦いにAIが役立つ方法

カリフォルニア州は、州を壊滅させた山火事に対抗する新たな武器、AIを手に入れました。 NVIDIAのGPUで訓練されたAIによって...

機械学習

「プロンプトエンジニアリングによるAIの潜在能力の解放」

迅速なエンジニアリングは、簡潔でコンテキスト豊かなクエリの作成スキルであり、AIが最も関連性の高い正確な応答を生成する...

機械学習

「AIの力による消費者の支払い行動予測」

「AIが予測能力を活用して消費者の支払行動を理解し、予測する方法を発見し、事業に行動可能な洞察を提供する」

データサイエンス

「Langchainとは何ですか?そして、大規模言語モデルとは何ですか?」

この包括的な記事では、LangChainとLarge Language Modelsの両方を探求します両方を理解するために、簡単なチュートリアルを...