Pandas 인덱스에서 모든 중복 값을 True로 표시하려면 index.duplicated() 메서드를 사용하고, keep 매개변수에 False 값을 지정하면 됩니다.
기본값인 keep='first'는 첫 번째 항목만 원본으로 남기고 나머지 중복만 True로 표시하지만, keep=False를 사용하면 중복으로 판단되는 모든 항목이 True로 반환됩니다.
1. 라이브러리 임포트
먼저 필요한 라이브러리를 가져옵니다.
import pandas as pd
2. 중복 값이 있는 인덱스 생성
중복 요소('Airplane')가 포함된 인덱스를 생성합니다.
index = pd.Index(['Car', 'Bike', 'Airplane', 'Ship', 'Airplane'])
3. 인덱스 출력
생성된 인덱스를 화면에 출력합니다.
print("Pandas Index with duplicates...\n", index)4. 모든 중복 값을 True로 표시
keep 매개변수를 False로 설정하여 모든 중복 인덱스 값을 True로 표시합니다.
print("\nIndicating all duplicate index values True...\n", index.duplicated(keep=False))전체 예제 코드
다음은 위 내용을 모두 포함한 전체 코드입니다.
import pandas as pd
# 중복 값이 있는 인덱스 생성
index = pd.Index(['Car', 'Bike', 'Airplane', 'Ship', 'Airplane'])
# 인덱스 출력
print("Pandas Index with duplicates...\n", index)
# 데이터의 dtype 확인
print("\nThe dtype object...\n", index.dtype)
# 데이터의 차원 확인
print("\nGet the dimensions...\n", index.ndim)
# 모든 중복 인덱스 값을 True로 표시
# keep 매개변수를 False로 설정
print("\nIndicating all duplicate index values True...\n", index.duplicated(keep=False))실행 결과
위 코드를 실행하면 다음과 같은 결과가 출력됩니다.
Pandas Index with duplicates... Index(['Car', 'Bike', 'Airplane', 'Ship', 'Airplane'], dtype='object') The dtype object... object Get the dimensions... 1 Indicating all duplicate index values True... [False False True False True]
결과 해석
출력 결과를 보면 'Airplane'이 두 번 등장하므로 해당 위치(2번째, 4번째)가 모두 True로 표시된 것을 확인할 수 있습니다. 만약 keep='first'(기본값)를 사용했다면 첫 번째 'Airplane'은 False로 유지되고 두 번째만 True가 됩니다. 이처럼 keep=False는 중복된 모든 항목을 한꺼번에 찾아낼 때 유용합니다.