파이썬의 슬라이싱 연산자 ':'를 활용하면 Series 데이터 구조에서 특정 범위의 요소에 손쉽게 접근할 수 있습니다. 이번 글에서는 이 연산자를 사용해 Series의 맨 아래(뒤쪽) n개 요소를 추출하는 방법을 알아보겠습니다.
예제 코드
import pandas as pd
my_data = [34, 56, 78, 90, 123, 45]
my_index = ['ab', 'mn' ,'gh','kl', 'wq', 'az']
my_series = pd.Series(my_data, index = my_index)
print("시리즈는 다음 요소들을 포함합니다")
print(my_series)
n = 3
print("하위 3개 요소는 다음과 같습니다 :")
print(my_series[n:])출력 결과
시리즈는 다음 요소들을 포함합니다 ab 34 mn 56 gh 78 kl 90 wq 123 az 45 dtype: int64 하위 3개 요소는 다음과 같습니다 : kl 90 wq 123 az 45 dtype: int64
코드 설명
필요한 라이브러리를 임포트하고, 사용 편의성을 위해 별칭(alias)을 지정합니다.
데이터 값들이 담긴 리스트를 생성한 후, 이를 pandas 라이브러리의 'Series' 함수에 매개변수로 전달합니다.
다음으로, 사용자 지정 인덱스 값들도 리스트에 저장하여 매개변수로 함께 전달합니다.
파이썬의 인덱싱 연산자 ':'를 사용하면 시리즈에서 특정 범위의 값에 접근할 수 있습니다.
':' 연산자는 하한값과 상한값 사이에 위치하며, [하한값 : 상한값] 형태로 작성합니다.
이 경우 결과에는 하한값은 포함되지만 상한값은 제외됩니다.
하한값을 지정하지 않으면 기본값 0이 적용됩니다.
상한값을 지정하지 않으면 데이터 구조의 길이(len(data structure))가 기본값으로 적용됩니다.
본 예제에서는 my_series[n:]처럼 작성했으므로, 하위 n개 요소, 즉 인덱스 n부터 마지막 요소까지가 선택됩니다.
마지막으로 print 함수를 통해 결과가 콘솔에 출력됩니다.
이처럼 음수 인덱스나 tail() 함수를 사용하는 방법도 있지만, 슬라이싱 연산자 ':'는 가장 직관적이고 널리 쓰이는 방식입니다. n 값을 변경하면 원하는 개수만큼의 하위 요소를 유연하게 가져올 수 있습니다.