トップ / フィルタ・サンプリング
重複行を取り除きます。メソッド名がSnowparkとPolarsで異なる点に注意してください。
df.distinct()
ldf.unique()
SnowparkはSELECT DISTINCT *に相当するSQLを発行します。Polarsはハッシュテーブルを使って行の重複を判定し除外します。処理として行うことは同じですが、実装のレイヤーが異なります(SQLエンジン側 vs Polarsのネイティブ実装)。
メソッド名がそのまま違う(Snowpark: distinct()、Polars: unique())ため、写経のときに書き間違えやすいです。Polars側でdistinct()と書いてもメソッドが存在せずエラーになります。
Polars 1.43.2 で実行確認 / Snowpark Python SDK 1.54.0 で静的検証(2026-08-21)