[만화 실시간 번역 이미지 뷰어] Manga Trans v1.2.0 업데이트
Manga Trans
일본어 만화를 한국어로 자동번역해주는 이미지 뷰어 프로그램입니다.
사실 1.0.0 올릴 땐 몇 명이나 써볼까 싶었는데, 생각보다 반응이 있어서 좀 놀랐고, 요청도 많이 들어왔습니다.
기억나는 것만 추려도 “ai 모델 번역", "말풍선 문제", "최신 그래픽카드 manga-ocr 설치 문제"
이 세 개는 거의 매번 나온 얘기라 이번엔 우선순위로 작업했습니다.
이번 업데이트의 핵심 내용은 AI 모델 향상 및 지원으로, 전반적인 번역 퀄리티가 크게 증가했습니다.
설치 및 사용법
아래 링크를 참고해주세요.
https://kone.gg/s/somisoft/b5A0XrVUUZIsH3eM6jcP8b
새로운 기능
1. 이제 말풍선을 정확하게 인식합니다
써보신 분들은 아시겠지만 기존 manga-ocr에 두 가지 문제가 있었는데,
하나는 효과음 같은 거까지 큰 말풍선으로 잡아버려서 그림이 가려지는 거였고,
잘못된 텍스트마저 통째로 번역기에 넘기다 보니 문맥이 꼬여서 번역이 이상하게 나오는 경우가 있었습니다.
이번 패치에서 말풍선 인식 모델을 바꿨습니다. 효과음 영역은 최대한 걸러내고 텍스트 인식 정확도 자체를 올리는 쪽으로 작업했고요,
잘못 잡히는 영역이 눈에 띄게 줄어든 걸 확인했습니다.
텍스트 인식 모델이 변경되었으므로, manga-ocr을 사용 중이던 분들은 앱 실행 시 추가 다운로드가 진행됩니다.
2. 로컬 AI 모델(Ollama) 번역 연동
1.0.0 때 로컬 모델 연결 안 하냐는 질문이 있었는데, 이번에 넣었습니다.
전제 조건은 Ollama를 직접 설치하시고 쓰실 모델도 미리 받아두셔야 한다는 겁니다. 프로그램이 대신 설치해주지 않습니다.
설정에서 Ollama 선택하고, 주소(기본값 http://localhost:11434/v1)랑 모델 이름만 넣으시면 됩니다.
받아둔 모델 이름은 cmd에서 ollama list 치면 나오니까 그대로 복사해서 넣으시면 됩니다.
번역 품질은 모델마다 편차가 꽤 커서, 각자 맞는 걸 찾으시는 게 좋을 것 같습니다. 대신 API 비용이 안 든다는 게 확실한 장점입니다.
컴퓨터 성능이 그리 좋지 않다는 분들은, 아래 클라우드 번역을 고려해보세요.
3. 클라우드 AI 모델 번역 연동 (gemini, claude, gpt, openai 규격 호환)
로컬 말고 제미나이, GPT, 클로드 같은 클라우드 모델도 붙였습니다.
구글 번역이 문맥 놓치고 엉뚱하게 번역하는 경우도 종종 있었는데, 클라우드 AI 모델은 이런 게 확실히 덜합니다.
앞뒤 대사 참고해서 번역하니까 결과물도 자연스럽고요.
설정에서 쓰실 모델을 고르고 API 키만 넣으면 바로 됩니다. 키는 각 서비스 홈페이지에 가입해서 직접 발급받으셔야 하고요.
요즘 화제였던 NVIDIA NIM도 써보실 만합니다.
DeepSeek, Qwen, Gemma 같은 모델을 API 키만 받으면 무료로 쓸 수 있는데,
유료가 부담스러우신 분들은 이쪽으로 한 번 맛보세요. 속도는 느리지만 페이지 몇 장 정도 돌리는 용도로는 딱 맞는 것 같습니다.
OpenAI Compatible로 사용하시면 됩니다.
추가로 OpenAI Compatible, Ollama, Gemini 모델은 테스트했지만, Claude, GPT는 테스트하지 못했습니다.
관련 내용으로 버그가 있다면 알려주세요.
4. 말풍선 배경색 자동 채우기
이것도 요청 받았던 거였습니다.
말풍선이 크게 덮어버리니까 그림이 가려지고 몰입이 깨진다는 의견이었죠.
이제는 말풍선 영역의 제일 비율 높은 색으로 배경을 자동으로 채웁니다.
글자 색도 최대한 원본 색상으로 자동 추측하고요. 채색된 작품에서 원본 그림에 훨씬 자연스럽게 묻어가는 느낌일 겁니다.
수정된 사항
1. URL 이미지 번역 중 전체화면 전환하면 크롤링 멈추는 오류
전체화면 전환하면 브라우저가 숨겨진 창 리소스를 아끼려고 하다 보니 크롤링이 그대로 멈춰버리는 문제가 있었는데,
이제 전체화면 켜져 있어도 계속 진행됩니다.
2. 최신/AMD 그래픽카드에서 Manga-OCR 설치(torch) 오류
5070ti, 5090이나 AMD 그래픽카드 쓰시는 분들 중에 아래 오류로 데몬이 죽는 경우가 많았습니다.
"error": "Couldn't instantiate the backend tokenizer from one of: ..."최신/AMD 드라이버 환경에서 torch, transformers 의존성 설치가 꼬이는 게 원인이었고, 관련 설치 로직을 손봤습니다.
그래도 혹시 같은 오류가 계속 뜨면, cmd 열어서 아래 명령어 한 번 실행해보시고 다시 시도해주세요.
python -m pip install "transformers<5.0.0" sentencepiece protobuf tiktoken --force-reinstall그래도 안 되면 F12를 눌러 나오는 로그와
설정 → 시스템 환경 진단 → 진단 리포트 생성 및 복사로 나온 텍스트를 업로드해주시면 확인해보겠습니다.
3. 두 번째 브라우저 윈도우 켜져있으면 파일 안 열리던 오류
이미지 더블클릭해서 열 때 다른 창이 하나 더 떠 있으면 안 열리던 문제였는데 고쳤습니다.
여담입니다.
1.
ai는 미래입니다.
이번 버전의 제일 큰 변화는 로컬/클라우드 AI 번역 연동입니다. 구글 무료 번역 대비 문맥이나 품질 차이가 꽤 체감될 겁니다.
Ollama 이미 쓰시는 분들은 비용 걱정 없이 바로 써보실 수 있고, GPU 부담스러우시면 클라우드 모델 중 하나 골라서 API 키 등록하시면 되고,
위에 언급한 NVIDIA NIM처럼 무료로 풀린 것도 있으니 여러 개 테스트해보시는 것도 나쁘지 않을 것 같습니다.
개인적으로는 google aistudio에서 gemini-2.5-flash-lite 도 괜찮았는데요,
페이지 당 평균 1~3원 가량 들지만 속도는 시원합니다. 가성비치곤 번역 품질도 썩 나쁘진 않았고요.
이조차 부담스러우시다면, nvidia nim의 google/diffusiongemma-26b-a4b-it 모델도 추천드립니다.
번역 에러가 발생하신다면 모델 사양이 낮아서 그런 것이니, google/gemma-4-31b-it 모델을 사용해보세요. 대신 속도는 느립니다.
설정에서 자신만의 프롬프트를 추가해서 더 상세히 명령할 수 있습니다만,
저품질 모델을 사용할 경우 프롬프트나 윈도우 컨텍스트가 길면 번역 실패가 발생할 수 있으니 유의하세요.
이는 프로그램 오류가 아니라, 모델의 한계이므로 어쩔 수가 없습니다.
2.
말풍선 배경색 자동 채우기도 은근 체감이 큰 기능이라, 한 번 써보시면 예전으로 못 돌아가실 것 같습니다.
ai로 말풍선 배경을 인페인트하는 것 또한 고려했습니다…만,
실시간 번역이 메인인 만큼, 성능이 최우선이라 생각하기에 보류 중입니다.
3.
torch 오류는 이번에 손봤다고 해도 환경이 워낙 다양하고,
개인으로서는 테스트가 불가능한 영역이라 여전히 안 되는 케이스가 있을 수 있습니다.
그럴 땐 로그와 사용환경을 남겨주시면 계속 봐드리겠습니다. 양해 바랍니다.
다음 업데이트는 번역본 내보내기, 마우스 휠로 확대/축소 등 편의 업데이트를 생각중입니다.
버그나 불편한 점 있으면 언제든 댓글로 알려주세요. 읽어주셔서 감사합니다.
s/somisoft
• 157,564 subscribers- 1. 게시물 규정 양식
업로드 시 링크 암호화 & 필수 정보를 기입할 것
- 2. 질문
국룰, 암호화 링크 등 기본사항 질문 금지, 탭 미준수시 차단 및 삭제
- 3. 요청
요청 기준 및 양식 미준수 & 댓글로만 자료 복구 요청 시 차단
- 4. 미성년자 / 근첩 / 페미 / 다중계정
조금이라도 의심되면 선 차단, 후 해명
- 5. 좆목 / 네임드화
닉언, 네임드화 등 친목질 금지
- 6. 분탕 및 어그로 / 혐짤 / 낚시 / 뇌절
해당 카테고리의 차단 기간 및 가중처벌은 처리자 재량으로 판단
- 7. 홍보 / 판촉 / 거래
허용되지 않은 모든 형태의 홍보, 거래, 교환, 조건부 공유 시 차단
- 8. 쌀먹 / 바이러스
조건부 공유 & 수익성 링크 & 고의적인 바이러스 유포 시 갱신차단
- 9. 자료 분류 / AI
미검수 시 표기 필수, 생성형 AI를 사용한 자료의 제목에 AI 미기입 시 차단
- 10. 실사 / 토들러
업로드시 갱신 차단
- 11. 기타 세부 규정은 서브 공지사항 참고
Deleted comment.