2026.07.29 접속자 178
로그인 회원가입
HOT
[AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요?
파인튜닝

Retrieval-Augmented Generation 실제로 hallucination 줄어드나요?

딥러너 2026.06.15 07:09 조회 118 추천 9 댓글 5건
요즘 RAG 도입하는 회사들 많던데, 실무에서 써보니까 생각보다 복잡하더라고요. 물론 외부 문서 연결하면 답변이 조금 나아지긴 하는데, 결국 LLM 자체가 이상한 답변을 할 때는 RAG도 큰 소용이 없더라고요.

특히 retrieval 단계에서 관련 없는 문서가 많이 나올 때가 있어서, 오히려 모델을 더 헷갈리게 하는 것 같은 느낌이 들어요. 임베딩 모델을 바꿔보거나 top-k 값을 조정해봐도 한계가 있는 것 같고요.

혹시 프로덕션에서 RAG 잘 운영하시는 분 계신가요? hallucination을 실제로 측정하고 개선하는 방법이 뭔지 궁금합니다. 아니면 RAG 말고 다른 방식이 더 효과적인 건지도요.
추천 9 비추천 0
댓글 5

댓글목록

profile_image
딥러닝장인
저도 같은 경험이 있어요. retrieval이 엉망일 때 오히려 noise만 늘어나더라고요. 결국 벡터 DB 품질이 가장 중요한 것 같은데, 전처리와 청킹 전략을 많이 신경 써야 hallucination이 줄어드는 것 같습니다. 그리고 retrieve한 문서의 relevance score를 threshold로 필터링하는 것도 도움이 되네요.
profile_image
인공지능개그맨
저도 비슷한 경험했어요 ㅋㅋ retrieval이 자꾸 잡음 넣어가지고 더 헷갈리더라고요. 결국 전처리가 정말 중요한 것 같아요. 문서 청크 사이즈 조정하고 메타데이터 활용해서 필터링 하니까 좀 나아지긴 했는데, 여전히 한계는 있네요. 혹시 혼합 retrieval (BM25 + 벡터) 써보셨어요? 저는 그게 좀 도움 됐거든요.
profile_image
궁금하면
저도 같은 경험했어요. RAG 도입하고 처음엔 기대했는데 retrieval 품질이 생각보다 중요하더라고요. 관련 없는 문서가 섞이면 오히려 hallucination이 더 심해지는 느낌이 들었어요.
저희 팀은 retrieval 단계에 re-ranking 모델을 추가했는데 좀 나아졌습니다. 임베딩만으로는 의미론적 관련성을 못 잡는 경우가 있거든요. 그리고 무조건 많은 문서를 넣기보다 정말 필요한 것만 엄선하는 게 핵심인 것 같아요.
hallucination 측정은 저희는 주기적으로 샘플 테스트하고 사실 검증 로직을 따로 두고 있어요. 완벽한 방법은 아니지만 지금까지는 이 정도가 현실적
profile_image
따뜻한코더
저도 같은 거 겪고 있었어요 ㅠㅠ
profile_image
AI소연이
저도 같은 문제 겪었는데, 결국 retrieval 품질이 핵심이더라고요. 임베딩 모델보다는 청킹 전략을 바꿔보셨어요? 문서 분할 방식을 조정하니까 관련 없는 거 덜 나오더라고요. 그리고 LLM hallucination 자체는 RAG만으로는 못 잡는다고 봐요. 생성 후에 fact verification 레이어를 따로 두는 게 낫더라고요.