kone
소미소프트

소미소프트

어찌저찌 실시간 번역하는 것은 성공시켰는데

05/03/2026, 17:21:42
질문
4427 views · 3 likes

염월 하고싶어서 LLM을 깔고 유틸에 올라와있는 설정대로 만들었는데 우선 어떻게 되는거 같긴하더라고 그런데
로컬번역이 일단 13초 정도로 너무 느리고 출력되는 것도 어떤건 번역이 출력되고 어떤건 안되더라고
그렇다고 기기 문제냐? 그건 또 아닌게 최근에 맞춘 컴퓨터라 기기 문제는 아닌거같아
내가 AI쪽 LLM을 다루는 것은 처음이라 혹시 어떤걸 만져봐야하는지 알려줄 수 있을까?


3
8 comments
Sign in to comment
차라리 MORT같은 기성제품 쓰는건 어떰? 이건 OCR 번역기임.
05/03
모델에 it 붙은걸로 해봐
05/03
결론부터 말씀드리면, RTX 5070 Ti에서 해당 모델을 사용하는 것은 다소 무리가 있을 수 있습니다. 이미지 속의 모델은 Gemma-4-26b-a4b로 보이며, 이는 구글의 최신 Gemma 4 라인업 중 하나인 26B 파라미터 규모의 MoE(Mixture-of-Experts) 모델입니다. 사용 환경에 따른 적합성 여부를 정리해 드립니다. 1. VRAM 용량 부족 RTX 5070 Ti 스펙: 이 그래픽 카드는 16GB GDDR7 메모리를 탑재하고 있습니다. 모델 요구 사양: 이미지에 표시된 Gemma-4-26b-a4b 모델의 파일 크기는 17.99 GB입니다. 4비트 양자화 모델임에도 불구하고, 실제 구동 시에는 컨텍스트(대화 기록) 처리를 위한 추가 메모리(KV Cache)가 필요하여 최소 18GB 이상의 VRAM이 권장됩니다.
05/03
결과: 모델 파일 크기 자체가 그래픽 카드의 전체 VRAM 용량(16GB)을 초과하기 때문에, GPU 메모리에 모두 올리지 못하고 시스템 RAM을 빌려 쓰는 '오프로딩(Offloading)'이 발생합니다. 2. 성능 저하 우려 VRAM이 부족하여 시스템 RAM을 사용하게 되면 생성 속도가 극도로 느려집니다. 16GB VRAM 환경에서는 모델의 일부 레이어만 GPU에서 처리되므로, 쾌적한 실시간 대화는 어려울 가능성이 높습니다. 3. 추천 대안 해당 그래픽 카드(16GB VRAM)에서 더 쾌적하게 사용할 수 있는 모델들은 다음과 같습니다. https://ifh.cc/v-9Qq1Kf 요약하자면: 26B 모델은 16GB VRAM을 가진 RTX 5070 Ti에서 구동은 가능할지 모르나(RAM 공유 시), 속도가 매우 답답할 것입니다. 더 원활한 사용을 원하신다면 Gemma 4 E4B나 8B 이하급 모델을 사용하시는 것을 권장합니다.
좌측하단 설정 위에서 5번째칸 가드레일오프 추천모델 Gemma 4 E4B-it
05/03
E4b uncensored 모델 쓰셈.성능 딸리면 26b는 못 돌림
05/04
5070ti에서 26b iq4_XS 잘 돌아감 가드레일오프하고 체크박스 다 켜면 됨 챗지피티 너무 믿진 말고
Sign in to comment
여기에 자작게임 올려도 되나요?
질문
곰돌123
05/27 4986 50
여러분 육변기 소꿉친구 망가 질문합니다.(그림첨부)
질문
하이바라
02/24 16904 23
깡계로서 소신발언 함
질문
greeding
02/02 11756 38
보지에 타코야끼 들어가는 쯔구르 야겜 좀 찾고 싶음
질문
바우탐
01/07 11406 47
"AI 오나사포 Premier" 해보신 분께 질문 드립니다. (충격먹음)
질문
asdvzxcv1
12/08/25 15735 64
종말의 얼터에고이즘 common events 아마도 작업 완료 한 거 같은데
질문
h7474
11/04/25 8958 20
옛날겜 찾아줄수있냐
질문
ㅇㅇ
10/26/25 5049 15
이건 질문이랄까 설문인데
질문
bisesdop
08/10/25 12135 21