검색 단계가 생성 단계에 넘겨야 할 것
RAG는 검색과 생성 사이에 명확한 계약이 있을 때 작동해. 검색한 청크, 각 청크의 출처, 결과를 얼마나 믿을지 판단할 신호가 필요해. 하나라도 빠지면 LLM이 근거 없이 답하거나 인용을 만들지 못해.
모든 검색 결과에 필요한 세 가지
- 텍스트 — 임베딩할 때 사용한 청크 내용 그대로야.
- 출처 — 파일 경로, URL, 문서 ID, 청크 순서처럼 생성기와 사용자가 원문을 되짚을 수 있는 정보야.
- 점수 — 유사도나 재순위화 점수로, 신뢰도가 낮은 결과가 프롬프트에 들어가기 전에 걸러.
최소한으로 작동하는 RAG 순환
question -> embed -> retrieve top-k -> filter by score -> stuff into prompt -> generate -> render with citations
쿼리 재작성, 다중 쿼리, 재순위화, 요약은 모두 최적화 단계야. 먼저 이 기본 순환을 작동시키고, 평가 집합이 실제로 약하다고 보여 주는 부분만 개선해.