
ai model📚 커리큘럼 학습#19 · 2026. 8. 22.
검색(RAG) 없이 사내 문서로 답하게 만드는 3단 사후학습
LLM은 추론 시점에 원문을 넣어주지 않으면 특정 문서 모음에 답하지 못합니다. IAR은 이를 문서 지식 내재화 문제로 봅니다. Inject는 원문을 이어쓰기·재작성·재구성 세 목표로 바꿔 주입하고, Align은 QA 지도학습으로 답변 행동을 맞추며, Recover는 적응된 모델을 원래 instruct 모델과 병합합니다. Llama·Qwen 등 8개 조합 중 7개에서 Vanilla SFT를 4개 지표 모두 앞섰고, 그 대비 도메인 QA +3.6%p, 일반 성능 +12.1%p입니다.















