トップ / 式評価・文字列・型変換
文字列の長さ(文字数)を求める。
length(col("name"))
pl.col("name").str.len_chars()
どちらも既定で文字数を返す。Snowflake公式ドキュメントは「UTF-8文字は1文字としてカウントする」と明記しており、実行して確認したところ「こんにちは」(5文字)はSnowpark・Polarsとも5になる(バイト数ではない)。
Polarsにはバイト数を返す別のメソッドstr.len_bytes()が存在し、名前が紛らわしい。実行して確認したところ「こんにちは」はlen_bytes()だと15(UTF-8で1文字3バイト×5)になる。日本語を含む文字列で誤ってlen_bytes()を使うと、Snowflake側のLENGTH(文字数)とは異なる大きな数値になる。
Polars 1.36.1 で実行確認 / Snowpark Python SDK 1.51.1 で静的検証(2026-08-29)