개요
엑셀 스프레드시트의 데이터를 Python 딕셔너리(dictionary)로 변환하는 가장 쉽고 효율적인 방법은 pandas와 같은 외부 라이브러리를 활용하는 것입니다. pandas는 Excel 파일을 손쉽게 읽어 들일 수 있으며, DataFrame 객체에서 제공하는 to_dict() 메서드를 통해 데이터를 딕셔너리 형태로 간편하게 변환할 수 있습니다.
사전 준비: pandas 설치
pandas가 아직 설치되어 있지 않다면, 아래 명령어로 간단히 설치할 수 있습니다.
pip install pandas
변환 예제
먼저 ExcelFile 클래스를 사용해 엑셀 파일을 불러온 뒤, 첫 번째 시트의 데이터를 파싱하고 to_dict() 메서드로 딕셔너리로 변환합니다.
from pandas import *
xls = ExcelFile('my_file.xls')
data = xls.parse(xls.sheet_names[0])
print(data.to_dict())실행 결과
위 코드를 실행하면 다음과 같은 출력 결과를 얻을 수 있습니다.
{'id': 10, 'name': "John"}참고 사항
최신 버전의 pandas에서는 xls.parse() 대신 read_excel() 함수를 사용하는 것이 권장됩니다. 또한 최근에는 .xlsx 형식을 지원하기 위해 openpyxl 라이브러리가 함께 필요할 수 있으니 참고하시기 바랍니다.
import pandas as pd
df = pd.read_excel('my_file.xlsx')
print(df.to_dict())이처럼 pandas를 활용하면 몇 줄의 코드만으로 스프레드시트 데이터를 Python 딕셔너리로 손쉽게 변환할 수 있어, 데이터 분석 및 전처리 작업의 생산성을 크게 높일 수 있습니다.