「合成イメージングがAIトレーニングの効率性を新たな基準に設定」

「合成イメージングがAIトレーニングの効率性を革新」

研究者たちは、大規模な設定で実施された実験において、合成画像のみで訓練されたモデルが、実際の画像で訓練されたモデルよりも優れていることを初めて示しました。 ¶ クレジット:Alex Shipps / MIT CSAIL、Midjourney AIイメージジェネレータ経由

マサチューセッツ工科大学(MIT)の研究者チームが示したところによれば、合成画像を用いて機械学習モデルを訓練することは、実際の画像を使用する従来の訓練方法よりも優れていることがわかりました。

この戦略は、「マルチポジティブ輪郭学習」として知られており、Stable Diffusionのようなテキストから画像への変換モデルを使用して、StableRepを用いて合成画像を生成します。

StableRepでは、生成モデル内の「ガイダンススケール」を調整し、合成画像の多様性と忠実度のバランスを取ることができます。

研究者たちはまた、言語の監督を追加したStableRep+を作成しました。彼らはStableRep+を2,000万枚の合成画像で訓練し、5000万枚の実際の画像で訓練されたCLIPモデルよりも効率的であることを確認しました。ただし、研究者たちは、テキストプロンプトの選択が完全にバイアスフリーではないことを認識しています。

MITのリージエ・ファンは、「最新のテキストから画像への変換モデルを使用することで、単一のテキスト入力から多様なビジュアルを得るために、過去に類を見ないほどの制御が可能になりました。これは、実世界の画像収集を超える効率性と多様性を持っています」と述べています。MITニュースからの引用 記事全文を見る

概要の著作権 © 2023 SmithBucklin、ワシントンD.C.、アメリカ

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

AI研究

UCSDの研究者が、チューリングテストでのGPT-4のパフォーマンスを評価:人間のような欺瞞とコミュニケーション戦略のダイナミクスを明らかにする

GPT-4はUCSDの研究者グループによってインターネット上の一般的なチューリングテストで試験されました。最も優れたGPT-4のプ...

機械学習

DevOpsGPTとは、LLMとDevOpsツールを組み合わせたマルチエージェントシステムであり、自然言語の要件を動作するソフトウェアに変換するものです

DevOpsGPTは、大規模な言語モデル(LLM)とDevOpsツールを組み合わせて、ソフトウェア開発のためのAIによる自動化ソリューシ...

AI研究

研究者たちは、ビデオ記録を使用して、鳥の姿勢を3Dで追跡するための新しいマーカーレスAIメソッドを開発しました

動物や鳥の行動、視線、微小な動きを追跡することは、研究者にとって困難な課題であり、正確な3Dアノテーションと複数の角度...

AI研究

このAI研究は、OpenAIの埋め込みを使用した強力なベクトル検索のためのLuceneの統合を提案します

最近、機械学習の検索分野において、深層ニューラルネットワークを応用することで大きな進歩がありました。特に、バイエンコ...

機械学習

「カートゥーンアニメーションの未来を照らす:ラインドローイングインビトのイノベーション」

“`html 1900年代初頭にアニメーション制作が始まって以来、カートゥーンアニメーションは大きな進歩を遂げてきました。...

データサイエンス

健康医療におけるバイアスとの闘いに参加する

Leo Anthony Celiは、あらゆる人口に対する臨床データの収集と分析において、産業が焦点を広げるよう招待しています