「合成イメージングがAIトレーニングの効率性を新たな基準に設定」

「合成イメージングがAIトレーニングの効率性を革新」

研究者たちは、大規模な設定で実施された実験において、合成画像のみで訓練されたモデルが、実際の画像で訓練されたモデルよりも優れていることを初めて示しました。 ¶ クレジット：Alex Shipps / MIT CSAIL、Midjourney AIイメージジェネレータ経由

マサチューセッツ工科大学（MIT）の研究者チームが示したところによれば、合成画像を用いて機械学習モデルを訓練することは、実際の画像を使用する従来の訓練方法よりも優れていることがわかりました。

この戦略は、「マルチポジティブ輪郭学習」として知られており、Stable Diffusionのようなテキストから画像への変換モデルを使用して、StableRepを用いて合成画像を生成します。

StableRepでは、生成モデル内の「ガイダンススケール」を調整し、合成画像の多様性と忠実度のバランスを取ることができます。

研究者たちはまた、言語の監督を追加したStableRep+を作成しました。彼らはStableRep+を2,000万枚の合成画像で訓練し、5000万枚の実際の画像で訓練されたCLIPモデルよりも効率的であることを確認しました。ただし、研究者たちは、テキストプロンプトの選択が完全にバイアスフリーではないことを認識しています。

MITのリージエ・ファンは、「最新のテキストから画像への変換モデルを使用することで、単一のテキスト入力から多様なビジュアルを得るために、過去に類を見ないほどの制御が可能になりました。これは、実世界の画像収集を超える効率性と多様性を持っています」と述べています。MITニュースからの引用記事全文を見る

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Artificial Intelligencecomputer applicationscomputers and societyhuman-computer interaction

Was this article helpful?

93 out of 132 found this helpful

「合成イメージングがAIトレーニングの効率性を新たな基準に設定」

Was this article helpful?

「訴訟は、MetaがInstagramやFacebookを子供たちをハメるためにデザインしたと主張しています」

「6Gは、気候変動の監視に二重の役割を果たすかもしれません」

AIニュース

関係データベースとその応用についての深い探求

「アメリカと欧州連合、データ共有に関する長らく待ち望まれた合意を完了」

「AIがキーストロークを聞く：新たなデータセキュリティの脅威」

「2023年のトップコンピュータビジョンツール/プラットフォーム」

このAI論文は、言語エージェントのための自然言語とコードの調和を目指して、LemurとLemur Chatを紹介しています

シュナイダーエレクトリックは、SageMakerでのリトリーバルアグメントドLLMsを活用して、ERPシステムのリアルタイムの更新を確実にしています