+
K
注: 以下の翻訳の正確性は検証されていません。AIPを利用して英語版の原文から機械的に翻訳されたものです。
DataFrame.distinct()
元の DataFrame の中で異なる行を含む新しい DataFrame を返します。
DataFrame
Copied!1 2 # 重複する行を削除します df = df.distinct()
1 2
# 重複する行を削除します df = df.distinct()
DataFrame.drop_duplicates(subset=None)
重複した行を削除した新しいDataFrameを返します。オプションで特定の行だけを考慮することができます。
Copied!1 2 3 4 # 重複する行を削除します df = df.drop_duplicates() # "firstname" と "lastname" の組み合わせが重複する行を削除します df = df.drop_duplicates(["firstname", "lastname"])
1 2 3 4
# 重複する行を削除します df = df.drop_duplicates() # "firstname" と "lastname" の組み合わせが重複する行を削除します df = df.drop_duplicates(["firstname", "lastname"])
DataFrame.dropna(how='any', thresh=None, subset=None)
エイリアス: DataFrame.na.dropna(how='any', thresh=None, subset=None)
DataFrame.na.dropna(how='any', thresh=None, subset=None)
null 値を含む行を省いた新しい DataFrame を返します。DataFrame.dropna() と DataFrameNaFunctions.drop() は互いのエイリアスです。
DataFrame.dropna()
DataFrameNaFunctions.drop()
パラメーター:
'any'
'all'
None
DataFrame.limit(number)
DataFrame.sort(*cols, **kwargs)
エイリアス: DataFrame.orderBy(*cols, **kwargs)
DataFrame.orderBy(*cols, **kwargs)
Column.asc()
F.asc(col)
Column.desc()
F.desc(col)