あなたの特徴は重要ですか?それが良いということではありません

特徴の重要性はありません

「特徴の重要性」だけでは不十分です。「誤差の寄与」も見る必要があります。モデルにとって有益な特徴を知りたい場合は。

[Image by Author]

「重要」と「良い」は同義語ではありません

「特徴の重要性」という概念は、機械学習において最も基本的なモデルの説明性の一種として広く使用されています。例えば、Recursive Feature Elimination (RFE) で使用され、モデルの最も重要でない特徴を反復的に削除します。

しかし、それについては誤解があります。

特徴が重要であることは、それがモデルにとって有益であることを意味しないのです!

実際に、特徴が重要であると言っても、それは単にその特徴がモデルによって行われる予測に対して高い貢献をもたらすことを意味します。しかし、そのような貢献は誤っている可能性があります

単純な例を挙げましょう。データサイエンティストが誤ってモデルの特徴の中から顧客IDを忘れてしまったとします。モデルは顧客IDを高い予測力を持つ特徴として使用しています。その結果、この特徴は実際にはモデルを悪化させてしまいますが、特徴の重要性は高くなります。なぜなら、それは未知のデータに対してうまく機能しないからです。

より明確にするために、2つの概念を区別する必要があります:

  • 予測の寄与:特徴による予測の一部です。これは特徴の重要性と同等です。
  • 誤差の寄与:モデル内の特徴の存在によって生じる予測誤差の一部です。

この記事では、これらの量を計算する方法と、予測モデルに関する価値ある洞察を得るためにそれらを使用する方法について見ていきます(そして、それを改善するために)。

おもちゃの例から始めましょう

仕事、年齢、国籍に基づいて人々の収入を予測するためのモデルを構築したとしましょう。今、そのモデルを使用して三人の予測を行います。

したがって、真の値、モデルの予測、および生じた誤差があります:

We will continue to update VoAGI; if you have any questions or suggestions, please contact us!

Share:

Was this article helpful?

93 out of 132 found this helpful

Discover more

人工知能

「Kognitosの創設者兼CEO、ビニー・ギル- インタビューシリーズ」

ビニー・ギルは、複数の役職と企業を横断する多様で幅広い業務経験を持っていますビニーは現在、Kognitosの創設者兼CEOであり...

人工知能

「スノーケルAIのCEO兼共同創設者、アレックス・ラットナー - インタビューシリーズ」

アレックス・ラトナーは、スタンフォードAIラボを母体とする会社、Snorkel AIのCEO兼共同創設者ですSnorkel AIは、手作業のAI...

人工知能

『DeepHowのCEO兼共同創業者、サム・ジェン氏によるインタビューシリーズ』

ディープハウのCEO兼共同創設者であるサム・ジェンは、著名な投資家から支持される急速に進化するスタートアップを率いていま...

人工知能

ファイデムのチーフ・プロダクト・オフィサー、アルパー・テキン-インタビューシリーズ

アルパー・テキンは、FindemというAI人材の獲得と管理プラットフォームの最高製品責任者(CPO)ですFindemのTalent Data Clou...

機械学習

3つの質問:大規模言語モデルについて、Jacob Andreasに聞く

CSAILの科学者は、最新の機械学習モデルを通じた自然言語処理の研究と、言語が他の種類の人工知能をどのように高めるかの調査...

人工知能

「サティスファイラボのCEO兼共同創設者、ドニー・ホワイト- インタビューシリーズ」

2016年に設立されたSatisfi Labsは、会話型AI企業のリーディングカンパニーです早期の成功は、ニューヨーク・メッツ、メイシ...