Which Python method can be used to Remove duplicates by Data scientist?
The drop_duplicates() method removes duplicate rows.
dataframe.drop_duplicates(subset, keep, inplace, ignore_index)
Remove duplicate rows from the DataFrame:
1. import pandas as pd
2. data = {
3. 'name': ['Peter', 'Mary', 'John', 'Mary'],
4. 'age': [50, 40, 30, 40],
5. 'qualified': [True, False, False, False]
6. }
7.
8. df = pd.DataFrame(data)
9. newdf = df.drop_duplicates()
Pilar
9 months agoStarr
9 months agoRenea
9 months agoCora
9 months agoMeaghan
10 months agoTammara
10 months agoDevorah
10 months agoBeth
10 months agoAriel
10 months agoJanet
10 months agoKina
10 months agoIsreal
10 months agoTonette
10 months agoWalker
11 months agoCecil
11 months agoRozella
11 months agoEmelda
2 years agoBulah
2 years agoKirby
2 years agoFannie
2 years agoDolores
2 years agoVincent
2 years agoSolange
2 years agoBambi
2 years agoDenna
2 years agoMy
2 years agoGlory
2 years agoAudry
2 years agoDulce
2 years agoCandra
2 years agoSylvie
2 years agoPilar
2 years agoEdgar
2 years agoAmalia
2 years agoBarbra
2 years agoIvette
2 years agoLynelle
2 years agoKimberely
2 years agoDominic
2 years agoDominga
2 years agoHuey
2 years ago