본문 바로가기
C.W.K.
Stream
퀴즈 · 4 questions

🔥 학습과 생성

Loss, 스케줄, 디코딩, 그리고 정렬

Level 0토큰 세는 사람
0 XP0/94 lessons0/10 achievements
0/120 XP to next level120 XP to go0% complete

Quiz

01GPT, Llama, Mistral이 쓰는 사전학습 objective는?
Hint
추론할 때 모델이 하는 일이랑 똑같아 — 다음 토큰 맞히기.
02DPO가 PPO/RLHF 대비 제거하는 것은?
Hint
DPO가 단순한 건 RLHF의 큰 부품 하나를 통째로 건너뛰기 때문이야.
03디코딩에서 temperature=0이 의미하는 건?
Hint
T가 0으로 갈 때 1/T가 어떻게 되는지 생각해 봐.
04큰 LLM 학습의 모던 기본 부동소수점 포맷은?
Hint
범위는 FP32인데 비트는 절반이고, GradScaler도 필요 없어.
이 페이지에서 버그를 발견하셨거나 피드백이 있으세요?문제 신고

댓글 0

🔔 답글 알림 (로그인 필요)
로그인댓글을 남기려면 로그인해 주세요.

아직 댓글이 없어요. 첫 댓글을 남겨보세요.