| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | ||
| 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| 27 | 28 | 29 | 30 |
- Java
- docker
- 이미지
- 정렬
- curl
- io
- Python
- Docker Compose
- podman
- json schema
- CSS
- PowerShell
- tauri
- scaler
- FileChannel
- cli
- Typescript
- vim
- Webpack
- 열선택
- RandomAccessFile
- vscode
- yaml
- Ollama
- drop_first
- Vite
- json
- scikit-learn
- UV
- pandas
- Today
- Total
목록2026/09/28 (2)
워로디스
pandas가 헷갈리는 이유는 비슷한 대괄호 문법이 상황에 따라 다르게 해석되기 때문입니다. 핵심은 df[...]와 .loc[...]의 해석 기준이 서로 다르다는 점입니다.1. df[...]는 안에 들어온 값의 종류에 따라 의미가 달라진다df['Fare']'Fare'는 열 이름이므로 열 선택입니다.df[['Fare', 'Age']]열 이름들의 리스트이므로 역시 열 선택입니다.반면:df[df['Fare'] 먼저df['Fare'] 의 결과는 다음과 같은 Boolean Series입니다.0 True1 True2 False3 True...그리고 pandas는df[boolean_series]형태를 만나면 Boolean 값에 따라 행을 필터링합니다.따라서:df[df['Fare'] 은Fa..
value_counts()는 Pandas에서 범주형 데이터의 분포를 빠르게 확인할 때 가장 자주 쓰는 함수 중 하나입니다. 핵심은 보통 DataFrame 전체보다 특정 컬럼(Series)에 사용하는 경우가 훨씬 많다는 점입니다.1. 가장 기본적인 사용: 값별 개수 세기df['Sex'].value_counts()예:Sexmale 577female 314Name: count, dtype: int64해석:male이 577개female이 314개즉, SQL의 GROUP BY + COUNT()와 비슷한 용도로 생각하면 됩니다.SELECT Sex, COUNT(*)FROM dfGROUP BY Sex;Titanic처럼 범주형 변수가 있는 데이터에서 가장 흔하게 사용합니다.df['Survived'].val..
