03/23/2023 / 最終更新日時 : 10/26/2025 Blue Python 【SHAP】スタッキング(stacking)で特徴量の解釈はできるのか|pythonアンサンブル学習 こんにちは、青の統計学です。 機械学習アルゴリズムの精度向上において、アンサンブル学習は非常に重要な役割を果たしています。 アンサンブル学習とは、複数の学習アルゴリズムを組み合わせることで、予測精度を向上させる手法です。 […]
03/10/2023 / 最終更新日時 : 10/26/2025 Blue Python 【Leave-one-out】データ量が少ない時に使うクロスバリデーション|python こんにちは、青の統計学です。 今回はデータ量が少ない時に有効な交差検証法の一種、Leave-one-outCVを紹介いたします。 Leave one out CV Leave-One-Out Cross-Validati […]
12/27/2022 / 最終更新日時 : 10/26/2025 Blue Python 【kaggle】ベイズ最適化とXGBでtitanicの予測問題を解く|python 今回はハイパーパラメータのチューニング手法の一つである、ベイズ最適について解説いたします。 グリッドサーチやランダムサーチに比べて、短い時間で最適なパラメータを発見できるとされています。 また、今回はデータ分析コンペのk […]
12/20/2022 / 最終更新日時 : 10/26/2025 Blue Python 【Box-Cox変換】様々な非線形変換について|python 今回は、モデル選択やパラメータチューニングの前に行う、特徴量エンジニアリングについて解説いたします。 中でも、非線形変換は特徴量の偏った分布を正規分布に近づけたりすることができ、高い精度につながることが多いです。 変数変 […]
12/07/2022 / 最終更新日時 : 10/26/2025 Blue Python 【XGB】交差検証法を使った勾配ブースティング決定木の実装|python 今回は、kaggleなどのデータ分析コンペでもよく使われる「勾配ブースティング決定木アルゴリズム」の解説を行います。 このコンテンツでわかること ・実際中身でどのような計算をしているのか ・コード例 勾配ブースティング決 […]
07/05/2022 / 最終更新日時 : 10/26/2025 Blue Python 【周期性を掴もう】pythonでコレログラムを書いてみましょう ヒストグラムや折れ線グラフなどはよく耳にしますが、「コレログラム」は聞いたことがないかたも多いと思います。 今回は統計検定2級や準一級でよく出る「コレログラム」についてまとめてみました。 統計検定のチートシートは以下をク […]
05/10/2022 / 最終更新日時 : 10/26/2025 Blue Python 【高校数学でわかる】分散と標準偏差をわかりやすく解説|散らばりの指標 分散(variance)と標準偏差(standard deviation) こんにちは、青の統計学です。 今回は、統計の基本である分散と標準偏差について解説していきます。 高校数学でも扱われる内容なので、高度な数学は必要 […]