로컬 LLM을 활용한 종합 번역 도구 제작 중
선 3줄 요약
이미지, 영상 번역 및 보강 도구 만드는 중 - 로컬
완성되면 오픈소스로 깃헙에 릴리즈 예정
건의사항, 아이디어 댓글 ㄱㄱ
프로젝트를 간단히 소개하자면 부가 기능 몇개 붙인 ‘로컬 LLM 기반 번역 쉽게 도와주는 번역기’ 라고 생각하면 될 듯.
중요 기능 추리면
1. 일본어 영상·음성 → 한국어 자막 - 사실 입력 일본어가 아니여도 되긴 함. 다른 언어도 지원
2. 영상 출력·후처리 - 자막 입히기, 음량과 소리 조절, 업스케일링, 화자 구분 등
3. 만화 이미지 번역 - 말풍선 인식, 덮어쓰기, 단어집 등
4. 프리셋 공유 - JSON으로 내 세팅 공유, 불러오기 가능함
이 과정 중 모든것들을 GUI로 파라미터 조절 가능, 조절한 값은 저장 됨 - 기본값으로도 적당한 퀄리티 제작 가능
진행 상황은 아직 테스트 단계이고 완성 되면 깃헙으로 오픈소스 릴리즈 할 듯. - 1~2주 예상
개발 자체는 거의 완성 단계인데, 만족스러운 결과 뽑는 기본 값 튜닝이 시간 많이 잡아먹는 듯
기여 쉽게 할 수 있게 하도록 노력 중이고 릴리즈하면 숨은 고수들이 기여 해주겠지..?
비개발자 중점으로 제작했고, WebUI 띄워서 GPU나 애플 실리콘 vram 용량 되면 일정 퀄리티 이상으로 번역 나올 수 있게 돌릴 수 있도록 하는게 목표임.
목표에 맞춰서 환경 자동 감지 넣었고, 의존성 일괄 설치 넣어서 쉽게 사용할 수 있음.
당연히 CLI도 있음.
다만 windows 중 nvidia 이외의 환경은 GPU 인식이 불가(Cuda/cudnn)해서 CPU로 돌려야함.
추후 개선 할 듯
제작 방식은 요즘 ai 코딩 에이전트 학습 중이라 틈틈이 시간 날때마다 100% 클로드 코드 바이브 코딩으로 진행함. 아이디어 설계부터 제작까지 3주쯤 걸린 것 같음
기본 번역은 Ollama로 qwen3.6-abliterated:27b 사용. 퀄리티가 제일 준수함
기술 스텍 및 다른거 궁금하거나 건의사항, 아이디어 댓으로 달면 달면 반영해보께
아래는 지금 진행 상황 간단히 캡쳐 떠온거임
디자인 좆구리다는 나쁜 말은 ㄴㄴ…
ui/ux 좆구리다는 나쁜 말도 ㄴㄴ…
+ 개발환경이 맥이라서 윈도우에서 이슈 없을지는 몰?루
++ 작명 잘하는 사람 이름 추천 좀. 지금 이름 너무 구림
s/somisoft
• 157,564 subscribers- 1. 게시물 규정 양식
업로드 시 링크 암호화 & 필수 정보를 기입할 것
- 2. 질문
국룰, 암호화 링크 등 기본사항 질문 금지, 탭 미준수시 차단 및 삭제
- 3. 요청
요청 기준 및 양식 미준수 & 댓글로만 자료 복구 요청 시 차단
- 4. 미성년자 / 근첩 / 페미 / 다중계정
조금이라도 의심되면 선 차단, 후 해명
- 5. 좆목 / 네임드화
닉언, 네임드화 등 친목질 금지
- 6. 분탕 및 어그로 / 혐짤 / 낚시 / 뇌절
해당 카테고리의 차단 기간 및 가중처벌은 처리자 재량으로 판단
- 7. 홍보 / 판촉 / 거래
허용되지 않은 모든 형태의 홍보, 거래, 교환, 조건부 공유 시 차단
- 8. 쌀먹 / 바이러스
조건부 공유 & 수익성 링크 & 고의적인 바이러스 유포 시 갱신차단
- 9. 자료 분류 / AI
미검수 시 표기 필수, 생성형 AI를 사용한 자료의 제목에 AI 미기입 시 차단
- 10. 실사 / 토들러
업로드시 갱신 차단
- 11. 기타 세부 규정은 서브 공지사항 참고
Deleted comment.