トップ / 集約・構造変換

group_by / groupBy

指定した列の値でグループ化する。集約する前段階として使う。

SNOWPARK 静的検証のみ

df.group_by("department")

POLARS 実行確認済み

ldf.group_by("department")

挙動・設計の違い

どちらも、この時点ではまだ集約を実行しない。グループ化キーを保持した中間オブジェクト(SnowparkはRelationalGroupedDataFrame、PolarsはLazyGroupBy)を返し、後続のagg()呼び出しを待つ設計が共通している。

移行時の落とし穴

SnowparkはキャメルケースのgroupByも別名として使えるが、Polarsはスネークケースのgroup_byに統一されている。SnowparkのコードをPolarsへそのまま移植するときgroupByと書いてしまうと存在しないメソッドになる。

集約・構造変換の他のメソッド

出典・検証情報

Polars 1.43.2 で実行確認 / Snowpark Python SDK 1.54.0 で静的検証(2026-08-22)