「PCAを基礎から構築する」

PCAの基礎構築

ステップバイステップの導出で主成分分析の理解を強化する

ホットエアバルーン。著者による画像。

主成分分析(PCA)は、次元削減によく使われる古い技術です。データサイエンティストの間ではよく知られたトピックですが、PCAの導出はしばしば見落とされ、データの性質や微積分、統計学、線形代数との関係についての貴重な洞察が失われることがあります。

この記事では、思考実験を通じてPCAを導き出し、2次元から任意の次元に拡張します。各導出を進めるにつれて、異なるように見える数学の分野が調和していることがわかり、優雅な座標変換に至ります。この導出により、PCAのメカニズムが明らかになり、数学的な概念の魅力的な相互関係が明らかになります。さあ、PCAとその美しさを探求する、この啓発的な旅に出かけましょう。

2次元でウォーミングアップ

私たちは3次元の世界に住む人間として、通常は2次元の概念を理解しています。この記事では、2次元から始めます。2次元から始めることで、最初の思考実験を簡素化し、問題の性質をよりよく理解することができます。

理論

次のようなデータセットがあります(各特徴は平均0、分散1にスケーリングされている必要があります):

(1) 相関データ。著者による画像。

このデータは、x1x2で表される座標系に存在し、これらの変数は相関しています。私たちの目標は、データの共分散構造に基づいて情報が含まれた新しい座標系を見つけることです。特に、最初の基底ベクトルは、元のデータをその上に射影する際に、分散の大部分を説明するべきです。

最初にやるべきことは、元のデータをベクトルに射影する際に、最大限の分散が保持されるようなベクトルを見つけることです。言い換えれば、理想的なベクトルは、最大の分散の方向を指すべきです。そのベクトルは…

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

人工知能

「Zenの共同創設者兼CTO、イオン・アレクサンドル・セカラ氏によるインタビューシリーズ」

創業者兼CTOであるIon-Alexandru Secaraは、Zen(PostureHealth Inc.)の開発を牽引しており、画期的な姿勢矯正ソフトウェア...

人工知能

「マーシャンの共同創設者であるイータン・ギンスバーグについてのインタビューシリーズ」

エタン・ギンズバーグは、マーシャンの共同創業者であり、すべてのプロンプトを最適なLLMに動的にルーティングするプラットフ...

AIニュース

OpenAIのCEOであるSam Altman氏:AIの力が証明されるにつれて、仕事に関するリスクが生じる

OpenAIのCEOであるSam Altmanは、特に彼の作品であるChatGPTに関するAIの潜在的な危険性について公言してきました。最近のイ...

人工知能

「サティスファイラボのCEO兼共同創設者、ドニー・ホワイト- インタビューシリーズ」

2016年に設立されたSatisfi Labsは、会話型AI企業のリーディングカンパニーです早期の成功は、ニューヨーク・メッツ、メイシ...

人工知能

「Kognitosの創設者兼CEO、ビニー・ギル- インタビューシリーズ」

ビニー・ギルは、複数の役職と企業を横断する多様で幅広い業務経験を持っていますビニーは現在、Kognitosの創設者兼CEOであり...

データサイエンス

「Adam Ross Nelsonによる自信のあるデータサイエンスについて」

データサイエンスの中で新たな分野が現れ、研究内容が理解しにくい場合は、専門家や先駆者と話すのが最善です最近、私たちは...