2026.09.14 접속자 125
로그인 회원가입
HOT
[프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [AI뉴스] 요즘 오픈소스 AI 모델들이 진짜 쌩쌩하네요. 뭐 써보셨어요? [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [프롬프트] AI한테 물어볼 땐 구체적으로 물어봐야 한다는 거 아시나요? [프롬프트] 코드 리뷰 프롬프트 좋은 거 있으신가요? [프롬프트] 챗GPT한테 물어볼 때 이 프롬프트 패턴 쓰니까 답이 달라지더라요 [AI뉴스] 한국 기업들 AI 도입했는데 제대로 써먹는 곳이 거의 없다더라 [AI뉴스] 요즘 AI 시장 정말 미친 속도로 움직이는 거 느껴지나요 [기술 Q&A] 토큰 길이 제한 없이 긴 문맥 처리하는 모델 어떤 거 써보셨어요? [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [AI뉴스] 요즘 오픈소스 AI 모델들이 진짜 쌩쌩하네요. 뭐 써보셨어요? [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [프롬프트] AI한테 물어볼 땐 구체적으로 물어봐야 한다는 거 아시나요? [프롬프트] 코드 리뷰 프롬프트 좋은 거 있으신가요? [프롬프트] 챗GPT한테 물어볼 때 이 프롬프트 패턴 쓰니까 답이 달라지더라요 [AI뉴스] 한국 기업들 AI 도입했는데 제대로 써먹는 곳이 거의 없다더라 [AI뉴스] 요즘 AI 시장 정말 미친 속도로 움직이는 거 느껴지나요 [기술 Q&A] 토큰 길이 제한 없이 긴 문맥 처리하는 모델 어떤 거 써보셨어요?
프롬프트

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

요정 2026.07.10 15:09 조회 196 추천 13 댓글 1건
요즘 자사 데이터로 모델을 파인튜닝하려고 하는데 문제가 생겼네요. 학습 데이터 중에 컨텍스트가 긴 문서들이 꽤 많거든요. 보통 4K 토큰 제한이 있는 모델 기준으로 초과하는 부분을 어떻게 처리하는지 궁금합니다.

지금까진 단순히 잘라내거나 요약하는 방식을 생각했는데 정보 손실이 많을 것 같아서요. 슬라이딩 윈도우 방식으로 여러 개 샘플로 나누는 게 나을까요? 아니면 애초에 더 큰 컨텍스트 윈도우 모델을 쓰는 게 낫나 싶기도 하고요.

실제로 장문 데이터로 파인튜닝해본 분들은 어떤 방식을 쓰셨는지 궁금합니다. 특히 성능 차이가 있었는지 궁금하네요.
추천 13 비추천 0
댓글 1

댓글목록

profile_image
딥러닝장인
저도 비슷한 문제 겪었는데 결국 슬라이딩 윈도우 방식이 제일 나더라고요. 단순히 자르는 것보다 정보 손실이 적고 샘플 수도 늘어나니까 학습도 잘 되는 것 같았어요. 다만 오버래핑 비율을 적절히 설정해야 하는데 보통 20~30% 정도로 했을 때가 제일 무난했습니다. 요약은 진짜 정보가 많이 빠져서 추천 안 하고요, 큰 컨텍스트 윈도우 모델은 당연히 좋지만 비용이 장난이 아니라서 상황에 따라 결정하셔야 할 것 같네요.