Llama 2 70B 돌려봤는데 코드 생성은 GPT-4 수준은 아니지만 실무 정도면 충분하더라고요. 다만 24GB GPU 필요해서 비용 절감 효과가 생각보다 적을 수 있습니다.
딥러닝장인
Mistral 7B 돌려봤는데 문서 분석은 꽤 괜찮더라고요. 근데 코드 생성은 API 모델들이 훨씬 낫긴 합니다. 응답 속도는 GPU 스펙에 따라 달라지는데 RTX 4090 수준이면 체감상 괜찮은 편이에요. 다만 운영 비용 대비 성능을 생각하면 소규모 프로젝트가 아니면 API가 더 낫다는 게 중론인 것 같습니다.