엑셀 파일 읽기/쓰기
엑셀 파일에서 데이터 프레임을 읽거나 데이터 프레임을 엑셀 파일로 쓰는 방법을 알아보겠습니다.
import pandas as pd
엑셀 파일 열기
데이터 프레임을 엑셀 파일에서 여는 방법을 알아보겠습니다. 엑셀 파일은 read_excel 함수로 엽니다.
df = pd.read_excel('census.xlsx')
여러 시트가 있는 엑셀 파일에서는 sheet_name으로 읽을 시트를 지정합니다. index_col에는 인덱스로 사용할 열을 지정합니다.
df = pd.read_excel('census.xlsx', sheet_name=0, index_col=0)
파일을 찾지 못할 때
FileNotFoundError가 발생하면 현재 노트북과 데이터 파일이 같은 폴더에 있는지, 파일 이름과 확장자가 정확한지 확인합니다.
첫 부분 보기
.head 메소드로 데이터 프레임의 첫 5행을 볼 수 있습니다.
df.head()
| age | workclass | fnlwgt | education | education_num | marital_status | occupation | relationship | race | sex | capital_gain | capital_loss | hours_per_week | native_country | income | |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 0 | 39 | State-gov | 77516 | Bachelors | 13 | Never-married | Adm-clerical | Not-in-family | White | Male | 2174 | 0 | 40 | United-States | <=50K |
| 1 | 50 | Self-emp-not-inc | 83311 | Bachelors | 13 | Married-civ-spouse | Exec-managerial | Husband | White | Male | 0 | 0 | 13 | United-States | <=50K |
| 2 | 38 | Private | 215646 | HS-grad | 9 | Divorced | Handlers-cleaners | Not-in-family | White | Male | 0 | 0 | 40 | United-States | <=50K |
| 3 | 53 | Private | 234721 | 11th | 7 | Married-civ-spouse | Handlers-cleaners | Husband | Black | Male | 0 | 0 | 40 | United-States | <=50K |
| 4 | 28 | Private | 338409 | Bachelors | 13 | Married-civ-spouse | Prof-specialty | Wife | Black | Female | 0 | 0 | 40 | Cuba | <=50K |
마지막 부분 보기
.tail()은 마지막 5행을 보여줍니다. 괄호 안에 행 수를 지정할 수도 있습니다.
df.tail(3)
저장
엑셀 파일로 저장할 때는 .to_excel 메소드를 사용합니다.
df.to_excel('new.xlsx', index=False)
index=False는 데이터 프레임의 인덱스를 파일에 별도 열로 저장하지 않습니다.