『SDXL 1.0の内部:Stability AI 新しいテキストから画像へのスーパーモデル』

SDXL 1.0の内部:Stability AI

新しいリリースは、以前のバージョンよりも大幅に改善され、最新のモデルと一致しています。

画像クレジット:Stability AI

最近、AIに特化した教育ニュースレターを開始しました。すでに16万人以上の購読者がいます。TheSequenceは、5分で読めるMLに特化したニュースレターで、ハイプやニュースなどは一切なく、機械学習のプロジェクト、研究論文、概念について最新情報をお届けします。ぜひ以下から購読して試してみてください:

TheSequence | Jesus Rodriguez | Substack

機械学習、人工知能、データの最新動向を把握するための最高の情報源…

thesequence.substack.com

Stability AIは、Stable Diffusionファミリーのモデルのリリースにより、テキストから画像への革命の中心にありました。最近の数ヶ月間、3D分類、制御可能な画像編集、画像パーソナライズ、合成データの増強、グラフィカルユーザーインターフェースのプロトタイピングなど、テキストから画像へのモデルに関連する研究領域での画期的な進展が目覚ましく見られました。

これらの進展の一部を取り入れることで、Stabilityは徐々にStable Diffusionを改善してきました。この作業の最新の成果は、SDXLのリリースであり、テキストから画像の合成のために設計された非常に高度な潜在的拡散モデルです。このリリースにより、SDXLはStability AIの最新のテキストから画像生成モデルとなりました。

SDXLは、ClipDrop、GitHub、またはStability AIプラットフォームを介して利用できます。

詳細について見ていきましょう。

SDXLアーキテクチャ

以前のStable Diffusionのバージョンとは異なり、SDXLは大幅にパラメータを増やしたUNetバックボーンを採用しています。これは、より多くのアテンションブロックと大きなクロスアテンションコンテキストのためです。また、2つ目のテキストエンコーダを含めることで可能になりました。新しい調整スキームが導入され、SDXLは複数のアスペクト比でトレーニングされます。生成されたサンプルの視覚的な忠実度をさらに向上させるために、後処理の画像から画像への技術を利用したリファイメントモデルが導入されています。

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

機械学習

3つの質問:大規模言語モデルについて、Jacob Andreasに聞く

CSAILの科学者は、最新の機械学習モデルを通じた自然言語処理の研究と、言語が他の種類の人工知能をどのように高めるかの調査...

人工知能

「パクストンAIの共同創業者兼CEO、タングイ・シャウ - インタビューシリーズ」

タングイ・ショウは、Paxton AIの共同創設者兼CEOであり、法的研究と起草の負担を軽減するためにGenerative AIを使用するプラ...

人工知能

ギル・ジェロン、Orca SecurityのCEO&共同創設者-インタビューシリーズ

ギル・ゲロンは、オルカ・セキュリティのCEO兼共同設立者ですギルは20年以上にわたりサイバーセキュリティ製品をリードし、提...

人工知能

Diginiのスマートセンスの社長、ガイ・イエヒアブによるインタビューシリーズ

ガイ・イハイアヴ氏は、ビジネスの成功に最も重要な資産を保護するためにインターネット・オブ・シングス(IoT)の力を活用す...

データサイエンス

「Adam Ross Nelsonによる自信のあるデータサイエンスについて」

データサイエンスの中で新たな分野が現れ、研究内容が理解しにくい場合は、専門家や先駆者と話すのが最善です最近、私たちは...

人工知能

「ジャスティン・マクギル、Content at Scaleの創設者兼CEO - インタビューシリーズ」

ジャスティンは2008年以来、起業家、イノベーター、マーケターとして活動しています彼は15年以上にわたりSEOマーケティングを...