2026.09.11 접속자 151
로그인 회원가입
HOT
[프롬프트] ChatGPT한테 "역할 지정"으로 물어보니까 답이 훨씬 달라지네요 [프롬프트] 클라이언트한테 설명하기 좋은 프롬프트 짜는 법 있을까요? [기술 Q&A] LLM 파인튜닝 할 때 토큰 수 계산 이게 맞나요? [AI뉴스] 요즘 생성형 AI 뭐가 핫한데? [프롬프트] 긴 문서 요약할 때 프롬프트 어떻게 하세요? [프롬프트] 데이터 분석 프롬프트 몇 달 써본 후기 - 실무에서 통하는 버전 [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 국내 AI 기본법이 EU보다 먼저 규제 시작...7월 시행령 본격화되는데 회사들 준비됐나 [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요 [프롬프트] ChatGPT한테 "역할 지정"으로 물어보니까 답이 훨씬 달라지네요 [프롬프트] 클라이언트한테 설명하기 좋은 프롬프트 짜는 법 있을까요? [기술 Q&A] LLM 파인튜닝 할 때 토큰 수 계산 이게 맞나요? [AI뉴스] 요즘 생성형 AI 뭐가 핫한데? [프롬프트] 긴 문서 요약할 때 프롬프트 어떻게 하세요? [프롬프트] 데이터 분석 프롬프트 몇 달 써본 후기 - 실무에서 통하는 버전 [프롬프트] 업무 자동화 프롬프트 찾는데 실제로 쓸 만한 거 있나요? [AI뉴스] 국내 AI 기본법이 EU보다 먼저 규제 시작...7월 시행령 본격화되는데 회사들 준비됐나 [AI뉴스] 2025년 AI도 본격적인 변화 시작... 실험에서 실전으로 넘어간다더라 [AI뉴스] 엔비디아 허깅페이스 인수, 17조원에 개방형 AI 생태계 판판이 깨졌네요
프롬프트

Llama 3.1 70B 로컬에서 돌려보니 이전 모델과 확실히 다르네요

흐름타는개발자 2026.08.11 22:26 조회 90 추천 8 댓글 0건
최근에 ollama로 Llama 3.1 70B 받아서 로컬 머신에서 굴려봤는데 생각보다 괜찮더라고요. RTX 4090 한 장에서 돌리고 있는데 토큰 생성 속도가 생각한 것보다 빠릅니다. 이전 Llama 2 70B랑 비교하면 응답 품질이 눈에 띄게 올라갔어요.

특히 코드 생성이랑 논리적 추론 부분에서 개선이 많이 된 걸 느꼈습니다. 같은 프롬프트로 테스트해봤는데 Llama 3.1이 context window를 훨씬 잘 활용하더라고요. 128K tokens 지원하는 게 실제로 느껴진다는 뜻이죠. 긴 문서 분석할 때 이전보다 훨씬 정확하게 처리하는 게 눈에 띕니다.

다만 메모리 문제는 여전히 고민이네요. 4-bit quantization으로 줄여도 VRAM이 상당히 필요해서 그래픽카드 좋은 거 필수입니다. 일반 노트북으로는 못 쓸 수준이죠. 그리고 한국어 처리는 여전히 약한 것 같아요. English prompt로 주면 괜찮은데 한국어 들어가면 품질이 뚝 떨어집니다.

혹시 로컬에서 오픈소스 모델 쓰고 계신 분 계신가요? 더 가벼운 대안이나 한국어 처리 잘 하는 다른 모델 있으면 추천 받고 싶습니다. 특히 비용 없이 프라이빗하게 쓸 수 있는 거 말이죠.
추천 8 비추천 0
댓글 0

댓글목록

아직 댓글이 없습니다. 첫 댓글을 남겨보세요!