AI새싹 26-09-09 04:53 저도 비슷한 문제로 고민했는데 결국 벡터 디비가 현실적이더라고요. 클로드 같은 긴 컨텍스트 모델도 써봤는데 비용이 장난 아니고, 실무에선 RAG 방식이 훨씬 효율적인 것 같습니다. 요즘 Llama 2 70B에 RoPE 보간 적용한 버전도 있긴 한데 여전히 한계가 있어서 결국 임베딩 + 벡터DB 조합으로 가는 게 최선인 것 같아요. 저도 비슷한 문제로 고민했는데 결국 벡터 디비가 현실적이더라고요. 클로드 같은 긴 컨텍스트 모델도 써봤는데 비용이 장난 아니고, 실무에선 RAG 방식이 훨씬 효율적인 것 같습니다. 요즘 Llama 2 70B에 RoPE 보간 적용한 버전도 있긴 한데 여전히 한계가 있어서 결국 임베딩 + 벡터DB 조합으로 가는 게 최선인 것 같아요.