학습이 줄이려는 숫자
손실함수는 예측과 목표의 차이를 최적화 가능한 숫자로 바꿔. 모델은 우리가 고른 손실을 줄일 뿐이므로, 손실 선택은 무엇을 좋은 예측으로 볼지 정하는 설계 결정이야.
| 손실 | 공식 | 성질 |
|---|---|---|
| MSE | 큰 잔차를 제곱해 강하게 벌줘. 이상치에 민감해. | |
| MAE | 잔차 크기에 선형으로 반응해 MSE보다 이상치 영향이 작아. | |
| 교차엔트로피 | 분류에서 정답 분포와 예측분포의 차이를 로그확률로 재. |
손실에는 통계적 가정이 숨어 있어
조건부 평균을 예측하고 가우시안 오차를 가정하면 MSE가 자연스럽고, 조건부 중앙값과 라플라스 오차를 생각하면 MAE가 이어져. 어떤 손실이 ‘더 좋다’기보다 목표와 오류 비용에 맞는지가 중요해.
교차엔트로피를 최소화하면 올바른 조건에서 참 조건부 확률을 목표로 하는 proper scoring rule이 되지만, 유한 데이터와 모형 불일치, 규제, 분포 변화 때문에 신경망의 확률이 자동으로 잘 보정되는 건 아니야. 정확도와 별도로 신뢰도 그림이나 Brier score, 온도 보정 같은 검사가 필요할 수 있어.
손실은 모델에게 무엇을 아파하라고 가르치는 자야. 최적화가 잘 됐다는 사실과 현실의 비용을 제대로 반영했다는 사실은 따로 검증해.