トップ / 結合・集合演算
2つのDataFrameを結合します。
df1.join(df2, df1["id"] == df2["id"], how="inner")
ldf1.join(ldf2, on="id", how="inner")
SnowparkはINNER JOIN等のSQL演算に変換され、Snowflakeのオプティマイザが結合アルゴリズムを選びます。Polarsはローカルの最適化器がハッシュジョインなどを実行します。どちらも遅延評価の対象で、実際の結合は後段のアクション/collectまで行われません。
同名のキー列がある場合の挙動が違います。Snowparkは結合後に同名列が2つ残り、そのままではどちらの列か曖昧になってエラーになりやすいです。Polarsはon="id"のように結合キーを指定すると、そのキー列は1つに整理されます(実機で確認済み)。ただしキー以外の同名列は_rightのような接尾辞つきの別名で両方残ります。
Polars 1.43.2 で実行確認 / Snowpark Python SDK 1.54.0 で静的検証(2026-08-23)