글처럼 읽히는 파이프라인
한 문장씩 쌓아 올린 Pandas 코드는 중간 변수 덤불로 자라기 쉬워 — df1, df2, df_filtered, df_filtered_grouped. Modern 스타일은 method chaining 이야. 모든 단계가 새 DataFrame 을 반환하고, 들여쓰기로 이어지고, 파이프라인이 위에서 아래로 연산 순서 그대로 읽혀.
이걸 받쳐 주는 메서드가 둘이야: assign() (입력을 건드리지 않고 column 을 추가하거나 덮어쓰기) 그리고 pipe() (체인 중간에 아무 함수나 끼워 넣기). query(), groupby(), sort_values() 와 엮으면 웬만한 분석 파이프라인이 들여쓰기 한 덩어리 안에 다 들어가.