gogumakimchi
u/gogumakimchi똑같은거 같네요.. precacher 는 포기하고 그냥 실시간 번역만 해야겠습니다 질문 빠르게 답해주셔서 감사합니다 정말 잘 쓰고있습니다
한번 다운받아 확인해보겠습니다 감사합니다
댓글로 물어보다가 사진 보여드리려 글쓴거라 설명이 부족했네요.. 죄송합니다 현재 processing prompt 가 너무 많이 나와서 속도가 느린것 같아 물어보는 중이었습니다
아 Precacher 사용중이었습니다 그럼 혹시 현재 스펙으로 더 좋은 모델 사용이 가능할까요? 글 몇개 찾아보니 8gb는 e4b가 괜찮다고 본거같아서요 그리고 일반적으로 사용할 때에도 번역이 빠르게 되기는 하지만 processing prompt 도 꽤 많이 뜨는거같네요
수정으로 사진 올리려니 안올라가네요 토큰은 85.83/초 나오는거 같습니다
https://kone.gg/s/somisoft/bDEw3dhQFfUJ5-GOwcMjGb 스샷을 먼저 보여드린다는걸 생각 못했네요 죄송합니다
네 LM Studio 상에서 점점 줄어들고 있네요 지금 미리 번역 돌리고 있는데 my models 확인해보면 13까지 떨어져있습니다 글카는 NVIDIA GeForce RTX 4060 사용중입니다
현재 google_gemma-4-E2B-it-GGUF 아니면 google_gemma-4-E4B-it-GGUF 사용중인데 processing prompt 가 너무 심할정도로 많이 나오네요 혹시 이것보다 더 성능 낮은게 있을까요? 글카는 8gb 짜리 사용중이고 작업관리자로 확인하면 4gb 정도만 사용중입니다 그리고 developer 상으로는 처음 설정한대로 gpu offload 가 최대치인 35로 설정되어있긴 한데 my models로 확인하면 점점 줄어듭니다. 이것도 문제가 될까요?
해결했습니다!