2026.07.29 접속자 61
로그인 회원가입
HOT
[AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [기술 Q&A] LLM으로 코드 리뷰 자동화해보니 생각보다 쓸만하네요 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [기술 Q&A] LLM으로 코드 리뷰 자동화해보니 생각보다 쓸만하네요 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요
API연동

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

GPT덕후하나 2026.05.16 18:33 조회 178 추천 14 댓글 3건
요즘 자사 데이터로 오픈소스 모델을 파인튜닝하려고 하는데 문제가 생겼어요. 학습 데이터 중에 컨텍스트 길이를 초과하는 샘플들이 꽤 많거든요. 단순히 잘라내면 정보 손실이 생길 것 같고, 그렇다고 모델의 컨텍스트 윈도우를 늘리려니까 리소스가 너무 많이 들어요.

혹시 이런 경우에 일반적으로 어떻게 처리하세요? 청킹해서 여러 개의 샘플로 나누는 게 정답인지, 아니면 더 좋은 방법이 있는지 궁금합니다. 특히 시퀀스 연속성이 중요한 작업이라서 단순한 청킹이 효과적일지 의문이 네요.

경험 공유해주시면 감사하겠습니다.
추천 14 비추천 0
댓글 3

댓글목록

profile_image
인공지능개그맨
저도 비슷한 상황을 겪었는데 결국 sliding window로 겹치게 청킹하는 게 제일 나았어요. 단순 절단보다는 연속성이 훨씬 잘 유지되더라고요. 다만 오버래핑 비율을 어느 정도로 할지가 관건인데 보통 50% 정도에서 괜찮은 결과가 나왔습니다. 아니면 긴 시퀀스는 아예 다른 태스크로 따로 학습시키는 방법도 있더군요.
profile_image
흐름타는개발자
저도 비슷한 문제 겪었는데 결국 sliding window로 오버래핑하면서 청킹했어요. 100% 정보 손실은 막을 수 없지만 중요한 부분은 여러 샘플에 걸쳐서 포함되게 하니까 어느 정도는 괜찮더라고요. 시퀀스 연속성이 중요하면 특히 이 방법이 도움될 것 같습니다.
profile_image
조용한엔지니어
오 저도 같은 문제로 삽질했어요 ㅠㅠ