2026.07.30 접속자 31
로그인 회원가입
HOT
[프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [프롬프트] Claude한테 좋은 프롬프트 쓰는 팁 공유합니다 [프롬프트] 코딩 프롬프트 어떻게 짜세요? 자꾸 엉뚱한 코드가 나와요 [AI뉴스] 이제 생성형 AI는 그냥 도구가 아니더라... 에이전틱 AI 시대가 온다는데 [기술 Q&A] LLM 파인튜닝할 때 LoRA 말고 다른 방법 써보신 분 있나요? [자유게시판] 요즘 집에서 혼자 밥 먹는데 왜 이렇게 허한거죠? [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [프롬프트] Claude한테 좋은 프롬프트 쓰는 팁 공유합니다 [프롬프트] 코딩 프롬프트 어떻게 짜세요? 자꾸 엉뚱한 코드가 나와요 [AI뉴스] 이제 생성형 AI는 그냥 도구가 아니더라... 에이전틱 AI 시대가 온다는데 [기술 Q&A] LLM 파인튜닝할 때 LoRA 말고 다른 방법 써보신 분 있나요? [자유게시판] 요즘 집에서 혼자 밥 먹는데 왜 이렇게 허한거죠?
API연동

LLM 토큰 길이 제한 걸릴 때 어떻게 처리하세요?

조용한엔지니어 2026.07.16 14:51 조회 50 추천 5 댓글 1건
최근에 긴 문서 분석하는 작업을 하고 있는데 토큰 길이 제한이 자꾸 걸려서 답답하네요. 특히 GPT-4 쓸 때 8K 모델이 아닌 기본 모델 쓰면 금방 튕겨 나가거든요.

지금은 그냥 문서를 직접 청킹해서 여러 번 나눠서 요청을 하고 있는데 이렇게 하면 컨텍스트 손실이 생기는 게 불가피한 것 같아요. 특히 전체 문서의 흐름을 이해해야 하는 작업이면 정확도가 떨어지더라고요. Langchain의 RecursiveCharacterTextSplitter를 써봤는데 이것도 완벽한 건 아닌 것 같고요.

혹시 실무에서 이런 상황 처리하는 좋은 방법이 있으면 궁금합니다. 벡터 DB에 임베딩해서 RAG 방식으로 가는 게 가장 나은 걸까요? 근데 그것도 관련 청크만 뽑아오는 거라 전체 맥락을 완벽히 잡기는 어렵지 않나 싶거든요.

Claude 같은 다른 모델들은 토큰 제한이 더 크다고 들었는데 실제로 써보신 분 있으신가요? 비용이 좀 더 나오겠지만 업무 효율 면에서 낫다면 도입해볼 만할 것 같은데 말이에요.
추천 5 비추천 0
댓글 1

댓글목록

profile_image
코드리뷰어
저도 같은 문제로 한참 삽질했는데요, 결국 Claude로 넘어갔어요. 100K 토큰이 정말 다르더라고요. 비용이 좀 올라가긴 하지만 청킹으로 인한 정확도 손실이 줄어드니까 결과적으로는 효율적이었어요. RAG도 함께 쓰긴 하는데 Claude 같은 큰 모델과 조합하면 훨씬 낫습니다.