Pandas는 다음의 종류의 데이터에 적합한 분석 패키지입니다.

그러면 판다스 왜 알야아 하는가?

우리가 모델을 돌릴때 가장 먼저 하는게 뭔가요?

⇒ sorce data를 먼저 읽어들인다. (csv, text 등)

그렇습니다. 데이터를 읽어들입니다.

그래서 우리도 데이터를 읽을 줄 알아야합니다.

제가 스터디할때 강조드리는거 기억하시나요?

데이터를 읽고 어떤 방식으로 처리할지 고민해야 한다고 항상 말합니다.

전처리를 어떻게 하냐에 따라서 여러분들의 AI 모델 성능이 좌지우지됩니다.

“데이터 품질”이 그래서 가장 중요합니다.

품질이 좋은 데이터로 학습된 모델은 성능이 좋습니다.

그래서 우리는 Pandas로 데이터 전처리, data cleaning을 진행합니다.

사람이 읽기 좋은 데이터 → ?