pandas 라이브러리를 사용하면 Excel 파일의 데이터를 손쉽게 불러와 원하는 열만 추출할 수 있습니다. 이 글에서는 첫 번째 열과 마지막 열의 모든 행을 읽어 출력하는 Python 프로그램을 단계별로 살펴보겠습니다.
사전 준비
이 예제에서는 로컬 환경에 pandas.xlsx라는 이름의 Excel 파일이 저장되어 있다고 가정합니다. 파일에는 'id'와 'productionYear' 같은 열이 포함되어 있습니다.
해결 방법
다음 단계를 따라 문제를 해결할 수 있습니다.
pd.read_excel()메서드를 사용하여 pandas.xlsx 파일의 데이터를 읽고, 이를 변수df에 저장합니다.
df = pd.read_excel('pandas.xlsx')df.iloc[:,0]을 적용하여 첫 번째 열의 모든 행을 출력합니다.
df.iloc[:,0]
df.iloc[:,-1]을 적용하여 마지막 열의 모든 행을 출력합니다.
df.iloc[:,-1]
예제 코드
아래 예제를 통해 실제 구현 방법을 더 잘 이해할 수 있습니다. 여기서는 CSV 파일을 사용했지만, Excel 파일도 동일한 방식으로 처리됩니다.
import pandas as pd
df = pd.read_csv('products.csv')
print("첫 번째 열의 모든 행:")
print(df.iloc[:,0])
print("마지막 열의 모든 행:")
print(df.iloc[:,-1])실행 결과
첫 번째 열의 모든 행:
0 1
1 2
2 3
3 4
4 5
...
95 96
96 97
97 98
98 99
99 100
Name: id, Length: 100, dtype: int64
마지막 열의 모든 행:
0 2019
1 2020
2 2018
3 2018
4 2018
...
95 2019
96 2019
97 2018
98 2020
99 2018
Name: productionYear, Length: 100, dtype: int64핵심 정리
iloc 인덱서는 위치 기반으로 데이터에 접근합니다. [:,0]은 모든 행(:)의 첫 번째 열(인덱스 0)을 의미하고, [:,-1]은 모든 행의 마지막 열을 의미합니다. 이처럼 음수 인덱스를 활용하면 열 개수를 몰라도 간편하게 마지막 열에 접근할 수 있습니다. 참고로 Excel 파일(.xlsx)을 읽으려면 openpyxl 패키지가 사전에 설치되어 있어야 합니다(pip install openpyxl).