Aprenda a remover linhas ou dropar linhas duplicadas no seu dataframe do pandas python. A função drop_duplicates permite vários parâmetros, como analisar apenas uma coluna e selecionar se o elemento mantido será o último o primeiro ou nenhum.
Códigos útilizados:
df.drop_duplicates()
df.drop_duplicates(subset='col1’)
df.drop_duplicates(subset='col1', keep='last’)
df.drop_duplicates(subset='col1', keep=False)
df.drop_duplicates(ignore_index=True)
Playlist sobre PANDAS: • Pandas
Playlist sobre PYTHON: • Python
Playlist sobre GRÁFICOS: • Gráficos
Playlist sobre JUPYTER: • Jupyter Notebook
#python #pandas #dataframe #dropar #duplicata #duplicado #remover #linha #linhas
0:00 Introdução
0:24 A função drop_duplicates
0:48 Focando em apenas uma coluna com subset
1:19 Selecionando linha a eliminar com keep
1:58 Resetando o index com ignore_index
2:26 Encerramento