RAG 골든셋 구축 방법 14부작 마스터 가이드: 13편 사용자 피드백 반영 실질 질의 고도화

1. 교과서형 시험지의 한계와 실전 현장의 간극 12편까지의 여정을 통해 청크 경계 정합성 오류를 우회하고, 지식베이스 내의 출처 충돌 예외 상황까지 깔끔하게 정리하는 고난도 인프라 정제 공정을 완수했다. 실데이터 연동 환경에서 발생할 수 있는 데이터 공학적 마찰을 철저하게 제어해 낸 것이다. 하지만 이 단계에서 수석 기획자가 마주하게 되는 또 다른 품질 장벽이 존재한다. 바로 현재까지 … 더 읽기

RAG 골든셋 구축 방법 14부작 마스터 가이드: 10편 분석 및 개선 회귀 루프

1. 점수판 확인 이후의 진짜 여정, 자가 개선 루프 9편에서 가동한 자동 채점기 eval-runner 시스템을 통해 검색(Retrieval) 레이어와 생성(Generation) 레이어로 완전히 격리된 다차원 수학적 메트릭 지표를 손에 넣었다. 파이프라인 전반부와 후반부 중 어느 구간이 취약한지 보여주는 정밀한 점수판이 완성된 것이다. 그러나 성능 리더보드 점수를 확인하는 것은 최종 목적지가 아니다. 채점의 진짜 가치는 점수가 낮게 터진 … 더 읽기

RAG 골든셋 구축 방법 14부작 마스터 가이드: 6편 점진적 배치(Batch) 추출 공정

1. 대량 생성의 유혹과 프롬프트 오염의 대참사 가성비 모델과 최고급 모델의 역할을 분비하는 하이브리드 LLM 앙상블 라우팅 아키텍처를 정립했다. 효율적인 구조가 설계되었다면, 이제 실제로 커버리지 맵에 등록된 지식 단위들을 시험 문제와 정답으로 바꾸어 내는 본격적인 ‘출제 공정’을 가동할 시간이다. 이때 많은 초보 기획자들과 개발자들이 빠지는 치명적인 유혹이 존재한다. 바로 “아키텍처도 완성되었으니 수백, 수천 페이지에 달하는 … 더 읽기