クロス集計表とヒートマップでデータセットを理解する
50列以上ある複雑なデータセットから「どの変数同士に関係がありそうか」を 見つけるための実践的なサーチ方法をまとめたリファレンスです。 Pandas のクロス集計表と Seaborn のヒートマップを使い、 度数分布の確認、クロス集計、正規化、可視化までを通して データの構造を素早く理解し“発見の糸口”をつかむ手...
50列以上ある複雑なデータセットから「どの変数同士に関係がありそうか」を 見つけるための実践的なサーチ方法をまとめたリファレンスです。 Pandas のクロス集計表と Seaborn のヒートマップを使い、 度数分布の確認、クロス集計、正規化、可視化までを通して データの構造を素早く理解し“発見の糸口”をつかむ手...
データ分析でよく使う DataFrame・ndarray・list の違いと使い分けを、実務目線でわかりやすく整理した How To 記事です。2次元データを扱う際に、それぞれの形式がどんな場面で適しているのかを比較し、用途に応じて変換できるようになることを目的に解説しています。
Python(Scikit-Learn)と SPSS Modeler の XGBoost を比較し、特徴量重要度がほぼ同じ結果になることを示しながら、実務で本当に重要なのはツールの違いではなく「どの特徴量を使うか」を決める前段階の判断であることを解説した記事です。地理的座標のようにドメイン知識で除外すべき特徴量を...
Illustrator のアピアランスパネルの仕組みと使い方を、塗り・線・効果の重なりや見た目の変化を GIF 動画つきでわかりやすく解説したページです。オブジェクトの実体を変えずに見た目だけを編集できるアピアランスの特徴や、重なり順・グラフィックスタイル・分割など、デザイン効率を高める基本操作を体系的にまとめて...
カテゴリカルデータの個数・構成比率・Total 行を、最小限のコードで一度に集計できる実務向けスクリプトを紹介します。日常の Excel 作業を Python でサクッと再現したい人のために、見やすい表への整形までをシンプルにまとめた How To 記事です。