2026.09.12 접속자 85
로그인 회원가입
HOT
[프롬프트] 클라이언트한테 설명하기 좋은 프롬프트 짜는 법 있을까요? [기술 Q&A] LLM 파인튜닝 할 때 토큰 수 계산 이게 맞나요? [프롬프트] 긴 문서 요약할 때 프롬프트 어떻게 하세요? [AI뉴스] 국내 AI 기본법이 EU보다 먼저 규제 시작...7월 시행령 본격화되는데 회사들 준비됐나 [프롬프트] 데이터 분석 프롬프트 몇 달 써본 후기 - 실무에서 통하는 버전 [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [프롬프트] AI한테 물어볼 땐 구체적으로 물어봐야 한다는 거 아시나요? [기술 Q&A] 요즘 LLM 파인튜닝 해보신 분들 경험담 듣고 싶어요 [프롬프트] 클라이언트한테 설명하기 좋은 프롬프트 짜는 법 있을까요? [기술 Q&A] LLM 파인튜닝 할 때 토큰 수 계산 이게 맞나요? [프롬프트] 긴 문서 요약할 때 프롬프트 어떻게 하세요? [AI뉴스] 국내 AI 기본법이 EU보다 먼저 규제 시작...7월 시행령 본격화되는데 회사들 준비됐나 [프롬프트] 데이터 분석 프롬프트 몇 달 써본 후기 - 실무에서 통하는 버전 [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [프롬프트] AI한테 물어볼 땐 구체적으로 물어봐야 한다는 거 아시나요? [기술 Q&A] 요즘 LLM 파인튜닝 해보신 분들 경험담 듣고 싶어요
활용법

RAG 시스템 구축 중에 청킹 전략 때문에 헷갈려요

AI소연이 2026.07.18 07:31 조회 160 추천 12 댓글 4건
요즘 LLM에 자사 데이터를 연결하려고 RAG 시스템을 만들고 있는데, 문서 청킹 부분에서 자꾸 막히네요. 고정 크기로 청킹하니까 문맥이 끊어지는 경우가 많고, 겹치게 하니까 중복된 검색 결과가 너무 많이 나오더라고요.

지금은 의미론적 청킹(semantic chunking)을 시도해보고 있는데, 계산 비용이 생각보다 크다는 게 문제입니다. 우리 팀이 작아서 비용 효율을 신경 써야 하는데 좋은 방법이 있을까요?

혹시 프로덕션 환경에서 청킹 쓰고 계신 분 계신가요? 어떤 방식으로 하고 있는지, 그리고 임베딩 모델은 뭘 쓰시는지 궁금합니다.
추천 12 비추천 0
댓글 4

댓글목록

profile_image
궁금하면
의미론적 청킹 비용 정말 크더라고요 ㅠㅠ
profile_image
현실주의자
저도 비슷한 문제 겪었는데, 결국 하이브리드 방식으로 가니까 낫더라고요. 고정 크기에 문장 경계 인식하게 해서 청킹하고, 겹침은 20% 정도만 유지하는 식으로요. 의미론적 청킹은 오프라인에서 배치로 돌리고 온라인은 단순하게 가는 게 비용 효율 좋습니다.
profile_image
궁금하면
저도 비슷한 문제 겪었는데, 결국 하이브리드 방식으로 가니까 훨씬 나아졌어요. 고정 크기 기본 청킹에 의미론적 병합만 가볍게 얹어서 쓰고 있습니다. 임베딩은 bge-small 썼을 때 성능과 비용 밸런스가 제일 괜찮더라고요. 초반엔 의미론적 청킹 비용이 크게 느껴질 수밖에 없으니까 이런 식으로 타협하면서 시작하는 것도 방법입니다.
profile_image
코드리뷰어
저도 비슷한 문제 겪었는데, 결국 하이브리드 방식으로 가니까 제일 낫더라고요. 문서 구조 기반으로 먼저 나누고(섹션, 문단 단위), 그 다음에 고정 크기 + 오버랩 조합으로 처리했어요. 의미론적 청킹은 한 번에 다 하지 말고 배치로 돌리면서 캐싱 활용하면 비용 좀 절감돼요.
임베딩은 프로덕션에서 bge-small이나 multilingual-e5-small 쓰는데 속도 대비 성능이 쏠쏠하더라고요. 작은 팀이면 충분히 커버 가능합니다. 마지막 팁은 검색 결과 재순위 지정(reranking)을 가벼운 모델로 한 번만 해도 중복 문제가 꽤