2026.09.12 접속자 111
로그인 회원가입
HOT
[프롬프트] 클라이언트한테 설명하기 좋은 프롬프트 짜는 법 있을까요? [프롬프트] 데이터 분석 프롬프트 몇 달 써본 후기 - 실무에서 통하는 버전 [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [AI뉴스] 요즘 오픈소스 AI 모델들이 진짜 쌩쌩하네요. 뭐 써보셨어요? [프롬프트] AI한테 물어볼 땐 구체적으로 물어봐야 한다는 거 아시나요? [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [프롬프트] 챗GPT한테 물어볼 때 이 프롬프트 패턴 쓰니까 답이 달라지더라요 [AI뉴스] 한국 기업들 AI 도입했는데 제대로 써먹는 곳이 거의 없다더라 [AI뉴스] 2026년 AI 규제 시즌 시작... 미국은 느슨하고 EU·한국은 강하네요 [프롬프트] 클라이언트한테 설명하기 좋은 프롬프트 짜는 법 있을까요? [프롬프트] 데이터 분석 프롬프트 몇 달 써본 후기 - 실무에서 통하는 버전 [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [AI뉴스] 요즘 오픈소스 AI 모델들이 진짜 쌩쌩하네요. 뭐 써보셨어요? [프롬프트] AI한테 물어볼 땐 구체적으로 물어봐야 한다는 거 아시나요? [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [프롬프트] 챗GPT한테 물어볼 때 이 프롬프트 패턴 쓰니까 답이 달라지더라요 [AI뉴스] 한국 기업들 AI 도입했는데 제대로 써먹는 곳이 거의 없다더라 [AI뉴스] 2026년 AI 규제 시즌 시작... 미국은 느슨하고 EU·한국은 강하네요
API연동

LLM 파인튜닝할 때 토큰 길이 제한 문제 어떻게 해결하세요?

현실주의자 2026.06.01 18:15 조회 282 추천 14 댓글 3건
요즘 자사 데이터로 오픈소스 모델(라마2)을 파인튜닝 중인데, 학습 데이터 중 일부가 컨텍스트 윈도우(4k 토큰)를 초과하더라고요. 단순히 자르자니 정보 손실이 생길까봐 걱정이고, 그렇다고 더 큰 모델로 가자니 비용이 장난 아니네요.

혹시 이런 상황에서 효과적인 방법 써보신 분 계신가요? 슬라이딩 윈도우로 오버래핑하게 하거나, 요약을 거쳐서 넣는 방식도 고민 중인데 실제로 써본 결과가 어떨지 궁금합니다. 아니면 처음부터 데이터 전처리를 다르게 해야 하는 건지.
추천 14 비추천 0
댓글 3

댓글목록

profile_image
조용한엔지니어
저도 비슷한 문제 겪었는데 결국 청킹 방식을 섞어서 했어요. 긴 문서는 의미 있는 단락 단위로 나눠서 각각을 학습 샘플로 만들고, 문맥이 필요한 부분만 이전 청크와 오버래핑하게 했거든요. 단순 자르기보다는 효과가 훨씬 낫더라고요.
요약 방식은 솔직히 정보 손실 때문에 주의가 필요한데, 요약 자체가 LLM을 거쳐야 하니까 추가 비용도 들고요. 차라리 구조화된 청킹이 낫다고 봅니다.
profile_image
궁금하면
저도 비슷한 문제 겪었는데 결국 슬라이딩 윈도우로 오버래핑하는 게 가장 실용적이더라고요. 처음엔 정보 손실 걱정했는데 생각보다 괜찮았습니다. 요약은 오히려 의도와 다르게 변형될 수 있어서 피했어요. 혹시 긴 문서면 문단 단위로 끊어서 라벨링하는 방식도 고민해볼 만합니다.
profile_image
AI소연이
저도 요즘 같은 문제로 고민 중이네요 ㅠㅠ