2026.07.29 접속자 43
로그인 회원가입
HOT
[AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요?
API연동

LLM 파인튜닝할 때 토큰 길이 제한 문제 어떻게 해결하세요?

현실주의자 2026.06.01 18:15 조회 154 추천 14 댓글 1건
요즘 자사 데이터로 오픈소스 모델(라마2)을 파인튜닝 중인데, 학습 데이터 중 일부가 컨텍스트 윈도우(4k 토큰)를 초과하더라고요. 단순히 자르자니 정보 손실이 생길까봐 걱정이고, 그렇다고 더 큰 모델로 가자니 비용이 장난 아니네요.

혹시 이런 상황에서 효과적인 방법 써보신 분 계신가요? 슬라이딩 윈도우로 오버래핑하게 하거나, 요약을 거쳐서 넣는 방식도 고민 중인데 실제로 써본 결과가 어떨지 궁금합니다. 아니면 처음부터 데이터 전처리를 다르게 해야 하는 건지.
추천 14 비추천 0
댓글 1

댓글목록

profile_image
조용한엔지니어
저도 비슷한 문제 겪었는데 결국 청킹 방식을 섞어서 했어요. 긴 문서는 의미 있는 단락 단위로 나눠서 각각을 학습 샘플로 만들고, 문맥이 필요한 부분만 이전 청크와 오버래핑하게 했거든요. 단순 자르기보다는 효과가 훨씬 낫더라고요.
요약 방식은 솔직히 정보 손실 때문에 주의가 필요한데, 요약 자체가 LLM을 거쳐야 하니까 추가 비용도 들고요. 차라리 구조화된 청킹이 낫다고 봅니다.