Computer >> 컴퓨터 >  >> 프로그래밍 >> Python

파이썬 Pandas Series에서 하위 n개 요소에 접근하는 방법

파이썬의 슬라이싱 연산자 ':'를 활용하면 Series 데이터 구조에서 특정 범위의 요소에 손쉽게 접근할 수 있습니다. 이번 글에서는 이 연산자를 사용해 Series의 맨 아래(뒤쪽) n개 요소를 추출하는 방법을 알아보겠습니다.

예제 코드

import pandas as pd
my_data = [34, 56, 78, 90, 123, 45]
my_index = ['ab', 'mn' ,'gh','kl', 'wq', 'az']
my_series = pd.Series(my_data, index = my_index)
print("시리즈는 다음 요소들을 포함합니다")
print(my_series)
n = 3
print("하위 3개 요소는 다음과 같습니다 :")
print(my_series[n:])

출력 결과

시리즈는 다음 요소들을 포함합니다
ab 34
mn 56
gh 78
kl 90
wq 123
az 45
dtype: int64
하위 3개 요소는 다음과 같습니다 :
kl 90
wq 123
az 45
dtype: int64

코드 설명

  • 필요한 라이브러리를 임포트하고, 사용 편의성을 위해 별칭(alias)을 지정합니다.

  • 데이터 값들이 담긴 리스트를 생성한 후, 이를 pandas 라이브러리의 'Series' 함수에 매개변수로 전달합니다.

  • 다음으로, 사용자 지정 인덱스 값들도 리스트에 저장하여 매개변수로 함께 전달합니다.

  • 파이썬의 인덱싱 연산자 ':'를 사용하면 시리즈에서 특정 범위의 값에 접근할 수 있습니다.

  • ':' 연산자는 하한값과 상한값 사이에 위치하며, [하한값 : 상한값] 형태로 작성합니다.

  • 이 경우 결과에는 하한값은 포함되지만 상한값은 제외됩니다.

  • 하한값을 지정하지 않으면 기본값 0이 적용됩니다.

  • 상한값을 지정하지 않으면 데이터 구조의 길이(len(data structure))가 기본값으로 적용됩니다.

  • 본 예제에서는 my_series[n:]처럼 작성했으므로, 하위 n개 요소, 즉 인덱스 n부터 마지막 요소까지가 선택됩니다.

  • 마지막으로 print 함수를 통해 결과가 콘솔에 출력됩니다.

이처럼 음수 인덱스나 tail() 함수를 사용하는 방법도 있지만, 슬라이싱 연산자 ':'는 가장 직관적이고 널리 쓰이는 방식입니다. n 값을 변경하면 원하는 개수만큼의 하위 요소를 유연하게 가져올 수 있습니다.