「合成イメージングがAIトレーニングの効率性を新たな基準に設定」

「合成イメージングがAIトレーニングの効率性を革新」

研究者たちは、大規模な設定で実施された実験において、合成画像のみで訓練されたモデルが、実際の画像で訓練されたモデルよりも優れていることを初めて示しました。 ¶ クレジット:Alex Shipps / MIT CSAIL、Midjourney AIイメージジェネレータ経由

マサチューセッツ工科大学(MIT)の研究者チームが示したところによれば、合成画像を用いて機械学習モデルを訓練することは、実際の画像を使用する従来の訓練方法よりも優れていることがわかりました。

この戦略は、「マルチポジティブ輪郭学習」として知られており、Stable Diffusionのようなテキストから画像への変換モデルを使用して、StableRepを用いて合成画像を生成します。

StableRepでは、生成モデル内の「ガイダンススケール」を調整し、合成画像の多様性と忠実度のバランスを取ることができます。

研究者たちはまた、言語の監督を追加したStableRep+を作成しました。彼らはStableRep+を2,000万枚の合成画像で訓練し、5000万枚の実際の画像で訓練されたCLIPモデルよりも効率的であることを確認しました。ただし、研究者たちは、テキストプロンプトの選択が完全にバイアスフリーではないことを認識しています。

MITのリージエ・ファンは、「最新のテキストから画像への変換モデルを使用することで、単一のテキスト入力から多様なビジュアルを得るために、過去に類を見ないほどの制御が可能になりました。これは、実世界の画像収集を超える効率性と多様性を持っています」と述べています。MITニュースからの引用 記事全文を見る

概要の著作権 © 2023 SmithBucklin、ワシントンD.C.、アメリカ

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

機械学習

上位10のLLM脆弱性

攻撃者はLLMの脆弱性を悪意のある活動に利用します主要なLLMの脆弱性とそれらの可能な緩和策について学びましょう

機械学習

「DRESS」とは、自然言語フィードバックを通じて人々と調和し、対話する大規模なビジョン言語モデル(LVLM)です

ビッグビジョン言語モデル、またはLVLMは、ビジュアルな手がかりを解釈し、ユーザーが簡単に対話するための簡単な返答を提供...

人工知能

二党間の法案が提出され、AIのリスクや規制に対処するためのブルーリボンパネルが提案されています

カリフォルニア州選出の代表テッド・リュウ(民主党)は、人工知能によって引き起こされるリスクを理解し、可能であれば規制...

AIニュース

内を見つめる

バイオセンシングは医療診断をより深いレベルにまで引き上げます

データサイエンス

LAION AIは、Video2Datasetを紹介しますこれは、効率的かつスケールでビデオとオーディオのデータセットをキュレーションするために設計されたオープンソースツールです

CLIP、Stable Diffusion、Flamingoなどの大規模な基盤モデルは、過去数年間にわたり、マルチモーダルな深層学習を劇的に向上...

AIニュース

「アマゾン対Google対マイクロソフト:AIで医療を革新する競争」

人工知能(AI)を医療業界に統合することは、技術の進歩の時代においてますます普及しています。Amazon、Google、Microsoftな...