kone
소미소프트
소미소프트

LM Studio로 로컬 ai를 활용해보기 + 추천 모델

07/19/2026, 02:25:47
정보
44765 views · 22 likes

https://lmstudio.ai/download

여기서 다운 받음. 윈도우용.

x86이라고 되어있는데 다운 받으면 x64로 되어있음. 정상.

Download LM Studio - Mac, Linux, Windows
Discover, download, and run local LLMs

이 글을 쓰는 시점 LM-Studio-0.4.19-2-x64.exe 가 최신.

1

설치하고 최초 구동하면

‘니 컴에 맞는 모델을 추천…’어쩌구 저쩌구 영어로 있음. 그거는 스킵하고 넘어감.

그리고 뜬 창이 이것.

(좌측 하단 톱니 누르면 설정에 한국어 있음. 근데 미번이 너무 많음)

좌측 상단을 보면 4개의 버튼이 있음(맨 위가 보라색)

여기서 네번째 버튼을 누름.

1

여기서 모델을 검색해서 받음.

1

예를 들면 이렇게.

여기서 우측에 보면 모델명이 있고 다운로드 버튼이 보이는데,

다운 버튼 위에 드롭단추를 누르면 프로그램이 자동으로 추천하는 모델 외에도 본인이 직접 고를 수 있음.

1

이런 식임.

좋아요 표시가 추천 모델, 다운로디드는 내가 다운로드를 완료한 모델.

녹색 버튼 표시는 ‘당신의 GPU에서 이 모델을 풀로드로 쓸 수 있음’ 표시임.

당연히 밑으로 내려갈수록 퀄리티가 좋아지는 대신 높은 하드웨어 스펙을 요구.

파란 버튼 표시는 ‘니 GPU로 이거 돌릴수는 있어도 풀로드는 불가’ 표시임.

여튼 나는 llmfan46 이라는 개발자가 개조한 젬마4 모델(양자화는 Q6_K)를 고름.

이하, 본인이 굴릴 수 있는 모델을 다운로드 받았다는 가정하에 설명 진행함.

다운로드 끝나면 세번째 버튼으로 감.

1

우측에 보면 인포, 로드, 인터페이스가 있는데 인포는 건들릴게 없음.

로드에서는 컨텍스트를 8192 정도로 해주면 됨. 2의 13제곱.

밑의 오프로딩은 최대값으로. 기본값이 최대일거임. 파란선으로 보이는건 저쪽 슬라이드 건드리면 저렇게 됨.

이렇게 로드에서는 두 가지 건드려 놓고, 다른거는 건드리지 말 것.

1

인터페이스로 감.

다운받은 모델에 추론기능이 있다면 리저닝 부분에 저렇게 토글 표시가 있을거임.

인에이블 팅킹이라고, 저것은 반드시 끌 것.

이 후 시스템 프롬프트에도 Do not use the thinking process. 라고 써서 한 번 더 강조해 줌.

추론 기능이 없는 모델이면 리저닝에 토글 버튼이 없고 영어로 뭐라 써있음. 무시.

이 외 건드릴 것 없음.

여튼 설정을 무엇든지 하나라도 건드리면 중앙 상단의 톱니바퀴에 빨간점이 뜸. 신경 쓸 것 없음.

이제 두번째 버튼으로 감.

1

서버세팅 누르면 밑에서 두번째 메뉴에 자동 언로드라고 있음. 기본값은 켜짐인데 꺼짐으로 변경.

그리고 서버포트는 기본값이 1234로 되어있는데 자유롭게 변경 가능하지만 굳이 바꿀 이유는 없음.

그런데 아주 드물게 1234번 포트를 다른 프로그램이 점유하고 있을 수도 있음.

그 경우에는 서버 가동이 안됨.

이것은 윈도우가 매 부팅때마다 포트가 필요한 프로그램에 무작위로 포트번호를 부여하는데, 로또 당첨으로 1234가 걸린거임.

재부팅하면 또다시 무작위 부여를 하기 때문에 통상 해결되지만 1234 포트를 아예 ‘무작위 분배에서 제외’ 시키고 싶다면 아래를 따라할 것.

1 - 명령프롬프트(cmd)를 관리자 권한으로 실행

2 - net stop winnat

3 - netsh int ipv4 add excludedportrange protocol=tcp startport=1234 numberofports=1

4 - net start winnat

5 - cmd 종료

이러면 1234번 포트는 예외가 됨. 즉 LM Studio에서 1234 포트를 쓸 때 절대 충돌이 날 일이 없음.

설정을 해제하고 싶다면

1 - 명령프롬프트(cmd)를 관리자 권한으로 실행

2 - net stop winnat

3 - netsh int ipv4 delete excludedportrange protocol=tcp startport=1234 numberofports=1

4 - net start winnat

5 - cmd 종료

을 하면 됨.

여튼 이후, 화면 상단 중앙에서 약간 오른쪽에 있는 파란색의 로드 모델을 누른다.

1

내가 가지고 있는 모델이 뜸.(노믹 임베드 뭐시기는 기본적으로 가지고 있는 것으로 쓸 일 없고, 무시하면 됨.)

저기서 내 모델을 선택하면 로드가 시작된다.

1

로드가 완료 된 모습.

가린 것은 솜붕이의 디렉토리로 사용자명이 노출되기 때문에 가렸다.

이제 이 상태에서 상단의 Status 를 한 번 클릭해주면

Stopped가 Running로 바뀐다. 이러면 로컬 ai를 사용할 준비가 끝난 것이다.

모델에 따라 다르지만, RAM과 VRAM을 굉장히 크게 점유하기 때문에

자기 하드웨어 스펙에 맞는 걸 고르는게 중요하다.

우측 중앙의 API Model Identifier 가 이 모델의 정확한 이름이 된다.

솜붕이의 모델은 gemma-4-26b-a4b-it-ultra-uncensored-heretic 이다. (llmfan46 / Q6_K)

이제 이것을 이용해 할 수 있는 건

1 - cmd에서 파이썬 코드를 이용하여 번역하기(번역용 파이썬 코드를 제작하거나, 게임에서 텍스트를 추출하는 건 또 다른 이야기…-_-)

2 - 루나 트랜스레이터에서 번역기로 활용하기(고급 모델이더라도 루나의 시스템프롬프트 편집과 사용자사전 편찬은 필수. 퀄 좋고 속도 매우 빠름.)

3 - 크롬의 웹사이트 번역 확장프로그램 Immersive Translate 에서 로컬 번역기로 활용하기(똥쓰레기 같은 크롬의 기본 번역 쓰다가 이걸 쓰게되면 세상이 달라짐. 물론 다소 고급 모델을 써야 하긴 함.)

것들이 되겠다.

일을 다 마쳤으면 서버를 멈추고, 이젝트 버튼을 눌러 모델을 언로드 하면 된다(그래야 램과 브램이 확보되므로).

물론 여유가 있다면 상시로 로드해 놔도 전혀 상관 없다.

가용 모델 정리

브램 8 / 16 / 24 / 32 순으로 색깔별 정리를 했다.

gemma-4-e4b-it-ultra-uncensored-heretic (Q8_0)

gemma-4-12B-it-qat-q4_0-uncensored-heretic-GGUF

gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF (Q4_K_S)

gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF (Q4_K_M)


gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF (Q5_K_S)


gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF (Q5_K_M)

gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF (Q6_K)


덧. 해당 모델은 테코키를 수음이라고 번역해서 대딸이나 핸드잡이라고 사전 등록을 해 놔야 맘이 편하다….-_-

22
28 comments
07/19
도움이 됐다면 좋겠네여
07/19 Edited 07/19
로컬은 상용에 비해 번역퀄 별로라던데
07/19
26b면 아주 가끔 안맞는 부분도 있는데 31b부터는 거의 문제 없더라 기업꺼로 눈치보면서 쓰는거보다 맘편해서 좋음
07/19 Edited 07/19
직접 해본결과 26부터는 퀄리티 매우 괜찮음. 가장 최신 모델인 지피티 5.6에는 당연히 못 미치겠지만.
로컬 사용하면, 야겜번역할때 문장 검열안하고 정상적으로 출력될려나?
ㅇㅇ
07/19 Edited 07/19
26b 모델의 경우 검열 해제율 97% 수준. 개조 버전 중 가장 오리지널에 가까운 31b의 경우 90%. 지능 면에서는 31b가 가장 높지만 31b와 26b의 지능은 근소한 차이고, 검열로 인한 출력 거부가 발생하는 것이 더 거슬리므로 26b를 강추함.
07/19
31b면 메모리 얼마나 먹음?
07/19 Edited 07/19
램 : 32이면 상당히 빡빡하게 돌아감. 다른 작업을 같이 하기엔 부담이 매우 큼. 내가 64인데 부팅 후 다른거 안 하고 모델 로드만 해도 램 사용량이 거의 45%에 육박함. 브램 : 최소 24를 추천. 32는 해야 한다 생각하지만 16에서도 돌아간다는 이야기를 들음. 모니터링 해 보니 내 경우는 시스템 기본 + 모델 로드 시 25 먹던데 어케 돌린다는건지 모르겠네. 잘 모르면 그냥 모델 고르고, 상세 모델은 좋아요 표시 있는 거 받으면 될 것. 참고로 브램 24짜리는 3090, 3090ti, 4090으로 이 3개 뿐임. 5090은 32.
07/19
근데 무턱대고 26b 31b 따라 쓰면 안되고 글카에 맞게 써야함 글카 딸리면 26b도 못해
그래서 본문에 자기 스펙에 맞는 걸 다운 받았다는 가정하에 설명함.
07/22
램 64에 4090을 스윽 꺼낸다..
그거면 Q5_K_S 쓰면 되겠네.
07/26
브램 16기가면 q4_k_m으로 써야함?
07/26 Edited 07/26
일단 Q4_K_S 먼저 써보삼. 해보고 빡빡하면 gemma-4-12B-it-qat-q4_0-uncensored-heretic-GGUF 로 가셈.
[deleted] 07/26 Edited 07/26

Deleted comment.

08/20
Samples
일반
코네
09/13 95 0
어흐 난 왜 이런게 너무좋지
일반
쁠뿡
08/31 420 0
최근에 본 작품인데 질문점 내용있음
질문
korean6638
08/31 419 0
자료 업로드 메가로 해도 괜찮나요?
질문
ddalddal2
08/31 559 0
요르티나 다햇는데 먼가 몬가임 ./....................
후기 및 공략
a123123a1231237
08/31 896 0
【하렘(?)/근친】나를 벌칙게임 소재로 삼지마! (삼아!) EX
동인
HoneyWorks
08/31 3318 11
요즘 뭔가 야겜들 퀄리티가 전반적으로 낮아지지 않았나요?
일반
ganzzi
08/31 1406 -3
그 옛날게임인데
질문
사과맛사탕
08/31 959 1
[그냥복구] 우리들의 육변기 선생님 -the GAME- 전 날라리엄마 교사의 변태 생활
복구
ttime490
08/31 3211 8
혹시 텍스트쪽에서 검열없는 ai 있을까요?
질문
ixa194
08/31 1556 1
오치카노 이 미친새기
작업현황
하츠네미쿠
08/31 1837 6
긴긴파크 꼴리긴 뒤지게 꼴리는데
후기 및 공략
ksikio123
08/30 1920 3
여자 작게만든다음 다리랑 뷰지 강제로 벌리는것도 좋네
야짤
superkiller123
08/30 3539 2
로리 거유 소녀에게 최면을 걸어 섹스하는 애니메이션 영상 게임
영상
ロリ巨乳
08/30 7041 16
직번) [James] 비몽사몽
동인
안드레
08/30 8321 7
샀다 보이즈..ㄷ
일반
쩝냡
08/30 5297 7
(직번)[몬무스]당신을 집착하는 니쿠사씨
동인
멕무
08/30 14200 17
스팀에서만 나오는 무인도 서바이벌 게임인데...
일반
haeun0511
08/30 5194 0
이런 것도 ntr 인가요 게임 추천 좀요
질문
양이오
08/30 4516 0
루나와 색욕의 고도 개지리넹
일반
İstiklâl Marşı
08/30 4061 0
이누히메 2.0 내년에 나오려나
일반
coke1566
08/30 4409 0
프린세스 시너지 초반에 비해 뒷심이 아쉽네
후기 및 공략
33709
08/30 4597 4
여친최면떳냐?
일반
sepisid
08/30 4814 3
시간 용자 엄청 재밌네 이거
일반
sinbalnom
08/30 4141 2
복구요청)RJ01368793-느슨한 서바이벌 ~알몸섬의 소녀들~
요청
ㅇㅇ
08/30 4405 0
[AI 번역][Kairaku Amnesia (Kinuo)] 가난한 아내가 집세를 보지로 갚을 때까지 ~28세 I컵 청초 아내, 악취나는 털복숭이 추남 집주인에게 NTR~
동인
crazyerdog
08/30 19564 29
아 게임 생각이 안나
질문
ghdrlfdl
08/30 3699 0
8월 마지막 날 그 긴거 예상중...
일반
ロリ巨乳
08/30 4780 2
망가 하나 찾아주실 수 있나요?
질문
churros
08/30 4124 0
[요청복구] RJ01295900 교배도시에 어서오세요 v1.03
복구
agnis
08/30 13942 21