kone
sub_icon

소미소프트

다시는 라데온을 무시하지 않겠습니다

2026-05-04 07:40:48
작업현황
조회 8620 · 좋아요 18

로컬 모델을 이용한 번역 하네스 엔지니어링 환경 구축을 위해 창고에서 잠자고 있던 우리집 최약체 라데온 3종을 깨웠다



1. RX 6900XT LC 16GB + RX 6800XT LC 16GB = VRAM 32GB



가오가이가 + 골디마그 = 히카리니이이이! 나레에에에엣!



역시나 걸음이 느린 아이 AMD네...CUDA에 비벼본다고 AMD가 밀던 ROCm이 이렇게 성능이 많이 올라왔을 줄은 생각도 못했다 속도면에서 많이 밀릴거라 생각했는데 예상을 뒤엎고 실시간 번역기에 대응 턱걸이로 가능한 퍼포먼스를 보여줬음. 이제 이 본체는 이제 24시간 QA / 번역용 에이전트로 쓰일 예정




2. RADEON VII 16GB 레퍼런스 에디션



얘는 AMD의 플루이드모션 빼곤 아무도 그리워하지 않는, 큰거온다 큰거온다 하다가 매번 실망을 준, 암드는 나와야봐야 안다 암레발이다의 굴욕적인 이미지를 모두에게 각인시켰던 희망고문 물로켓 GCN 아키텍처의 마지막 제품...그냥 박물관 감성 ( 을 빙자한 야동 프레임 뻥튀기용 ) 으로 남겨놨던 녀석인데...얠 AI용으로 쓰게 되는 날이 올 줄이야.


ROCm은 당연히 지원 못하는 관절염 할배지만 젬마 4 26B Q4 정도는 아슬아슬하게 소화 가능...! AI는 역시 램으로 시작해서 램으로 끝난다.



자 이제 이 퇴역군인 할배들로 어떤 병신같고 천박한 짓을 해낼 수 있을지 설렌다




*라데온으로 젬마4를 LM 스튜디오로 돌려보고 싶으신 분들은 딱 세가지만 기억하세요



1. AMD 공홈에서 HIP SDK 통합 드라이버를 받아 설치한다 (재부팅 필수)


https://www.amd.com/ko/developer/resources/rocm-hub/hip-sdk.html



2. LM 스튜디오를 설치한다


https://lmstudio.ai/download



3. 허깅페이스에서 내 체급에 맞는 젬마4를 받아 LM스튜디오에서 로드한다
 - 다운로드 받을 모델 용량이 내 VRAM보다 충분히 작으면 로드 가능하니 금방 감 잡을거임 Q4 미만 체급은 번역에서는 추천하지 않는다 번역문이 랜덤하게 찐빠날 확률이 점점 증가하므로...


- VRAM 6GB 이하 : Gemma 4 E2B

https://huggingface.co/mradermacher/gemma-4-E2B-it-heretic-ara-GGUF


- VRAM 8GB 이하 : Gemma 4 E4B

https://huggingface.co/mradermacher/gemma-4-E4B-it-ultra-uncensored-heretic-GGUF


- VRAM 16GB 이상 24GB 이하 : Gemma 4 26B A4B

https://huggingface.co/mradermacher/gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF


- VRAM 24GB 이상 : Gemma 4 31B

https://huggingface.co/mradermacher/gemma-4-31b-it-heretic-ara-i1-GGUF


heretic 모델로 통일한 이유는 솜붕이들은 음어와 각종 '못된 짓💓' 묘사가 검열될 가능성이 있는 모델은 용서하지 못할 테니까...



그럼 다들 쿨하고 섹시하고 인텔리전트하게 딸치자

18
댓글 34개
댓글 쓰기
05.04 (05.04)
난 6600 3070 9700 세가지 사용가능인데. 6600 아직도 사용중 ~~ 3070은 사펑 한다고 사고 ㅋ
RX 6600도 훌륭한 AI 인력이라는거슬.......아랏지롱!
05.04
검색해봤는데 어... 음... ... 그냥 5060ti 특가 나올떄 까지 기다릴게요.
집에 있던 라데온에 미리 실망하셨던 분들을 위한...예토전생 가이드
아드레날린 깔면 보이는 ai는 구데기인가?
NVIDIA가 CUDA SDK를 깔아야 제 속도가 나는 것 처럼 AMD는 HIP SDK 통합 드라이버 설치가 필수!
05.04
이미 AI 관리자가 되신 분
05.04
저런 로컬ai 그거 볼때마다 생각하는건데 엔비디아꺼 DGX인가 뭔가하는그 작고 존나 비싼 컴터 그거랑 ASUS Ascent GX10 이런거처럼 ai용으로 만든 그런거에다가 저런거 깔고 세탁기 탈수기마냥 와랄랄라 돌리면 기깔나고 빠르게 해주려나 궁금하던데 그렇게 쓰는사람이 있으려나
램 효율은 점점 좋아지는 중이니까 의도적으로 배포를 늦추지 않는 이상은 초소형 하드웨어에서도 가능해질거임 ㅋㅋ
05.04
그거 VRAM은 많은데 실제 속도는 조금 차이가 커서 해봐야 알거 같음 가격이나 전력 먹는거 감안하면 상당히 준수한 물건이지, 나중에 누가 써주고 후기라도 올려주면 좋겠는데 일반적인 사용 후기도 별로 없음 ㅠㅠ
05.04 (05.04)
내가 그거 쓰고 있는데, 이거 메모리 대역폭이 작은게 매우 치명적임 LLM은 추론속도가 거의 메모리 대역폭에 비례하기 때문에 차라리 대역폭이 4배이상 높은 3090이 4배 이상 빠름 중고 글카 다는게 나을지경 그래도 메모리는 넓으니까 진짜 큰 모델을 어떻게든 느린속도로라도 돌려보고 싶으면 괜찮긴함
vllm 으로는 서빙 못함? 이게 더 빠르지 않나?
05.04 (05.04)
LM는 접근성 때문에 미는거지 ㅜㅜ GGUF 모델의 경우는 vllm이 호환성에서 손해보는 경우도 좀 있기도 하고. 애초에 태생이 개인과 엔터프라이즈니까... 멀티모달 포기하고 속도 원툴로 갈거면 EXL2도 좋고
05.04 (05.04)
그치만 라데온 이자식 CUDA도 없고
아쉬운대로 ROCm 그거도 안되면 Vulcan
05.04
한때 최고의 곡괭이 라7
05.07 (05.07)
근데 옆동네 미연시 관련 챈에선, 로컬 모델 번역 퀄은 파파고만도 못하다던데...
어허 이싸람이 몇달전 얘길 하는거야 젬마4 안써봤어!
적어도 시스템 프롬프트는 다룰 줄 아는 사람이 한 말을 믿으셈
05.08
amd로도 이미지 뽑고 영상도 만들고 다 할수 있다 이거야
며칠 써보니 이젠 별로 느리지도 않네...장하다
0 / 500