シリーズ・全2本

表形式データの機械学習

表形式のデータなら勾配ブースティングから始めればよい、とよく言われます。ただ、実際にどのライブラリを選ぶかで結果はどれだけ変わるのか、精度以外の学習時間や解釈のしやすさまで含めるとどこで逆転するのかは、あまり測られていません。このシリーズでは、条件を揃えた比較を通してモデル選びを確かめています。学習後に出てくる特徴量の重要度や説明の読み方はモデル解釈のシリーズ、前処理と特徴量、不均衡データ、検証の落とし穴もそれぞれ別のシリーズで扱っています。

困っていることから選ぶ

連載順に読む