手把手用 Koharu 搭建本地漫画翻译流水线
告别云端机翻与隐私泄露。本教程带你从零配置 Koharu,掌握本地 OCR 识别、AI 翻译与排版擦除全流程。无需上传数据,一键完成漫画汉化实战。

告别机翻尴尬:用 Koharu 搭建本地漫画翻译流水线
追生肉漫画的同学都有过这种体验:冷门佳作没人汉化,硬啃原文又卡壳。市面上的在线翻译工具不仅把图片上传云端、翻译质量参差不齐,还存在隐私泄露风险。对于带版权属性的漫画内容,这种不确定性确实让人头疼。
今天带你搭建 Koharu 本地漫画翻译工具。它基于 Rust 开发,将视觉模型和 LLM 全部部署在本地,数据绝不出门。从漫画导入、文字检测、OCR 识别、AI 翻译、原文擦除到最终排版输出,整条流水线全部在本地跑通。
学完本篇,你将独立跑通单页漫画的完整翻译流程,并学会根据硬件条件配置最合适的模型。
一、前置条件
开始实战前,请确认你的环境满足以下基础要求:
- 操作系统:Windows 10+ / macOS(Apple Silicon)/ Linux 均可完美运行。
- 显卡配置:NVIDIA GTX 1660 及以上(CUDA)、Apple M 系列芯片(Metal)或支持 Vulkan 的显卡。CPU 也能跑,但推理速度会显著下降。
- 磁盘空间:模型文件体积较大,建议预留 10 GB 以上空间。
- 编译环境(仅源码构建需要):Rust 1.97.1+、Bun 1.3.14+、LLVM 22.1.8+。
二、安装与首次启动
方案一:包管理器安装(快速上手)
Windows 用户打开 PowerShell 执行:
bash
winget install koharu
macOS 用户确保已安装 Homebrew:
bash
brew install --cask koharu
安装完成后,终端输入 koharu 即可唤醒图形界面。
方案二:源码编译(开发者自定义)
适合想修改默认参数或贡献代码的同学:
bash
## 克隆仓库
git clone https://github.com/koharu-rs/koharu.git
cd koharu
## 安装前端依赖并构建
bun install
bun run build
编译完成后,Release 产物位于 target/release 目录。
模型选型指南
首次运行时,Koharu 会引导下载核心模型。根据你的硬件和翻译语种,建议按以下策略搭配:
- 检测与分割模型:推荐
Koharu Layout RF-DETR Seg 2XL,文字区域与气泡框线识别准确率最高。 - OCR 模型:日文漫画首选
Baberu OCR或Hayai OCR;需要多语言覆盖选PaddleOCR VL 1.6。 - Inpainting 模型:
FLUX.2 Klein背景修补最细腻,但吃显存;LaMa轻量快速,是低配环境的救星。 - 翻译引擎(LLM):本地运行推荐
Qwen 3.5 9B(GGUF 格式),12G 显存可流畅运行。追求极致质量可上Qwen 3.5 27B或Gemma 4 26B。网络通畅时也可接入 OpenAI 或 Claude API。
三、实战:翻译一页漫画
配置好环境后,我们拿一页实际漫画跑通整条管线。
第一步:创建项目
启动 Koharu 主界面,点击 New Project。支持拖入单张 PNG/JPG、ZIP/CBZ 压缩包(自动按文件名排序)或 PDF 文件。导入后系统会自动为页面编号。
第二步:配置处理管线
在项目设置面板,按需开启各处理节点:
- Detection:开启气泡与文字区域定位
- OCR:执行文字图像转文本
- Translation:设定源语言(通常为日语)与目标语言,绑定 LLM 或云端 API
- Inpainting:开启原文擦除与背景智能填充
- Typesetting:开启排版。强烈建议勾选“竖排中文/从右到左布局”,完美契合漫画阅读习惯。
所有步骤均支持单页级或全局级独立开关。例如某页为无文字封面,可直接跳过检测环节。
第三步:执行翻译
点击 Process,Koharu 将按预设顺序自动化执行:检测 → OCR → LLM 翻译 → 擦除 → 排版。
处理全程支持在 WebGPU 画布实时预览。遇到机翻生硬的地方,可随时暂停进入 Proofreading(校对)阶段人工修正台词。
第四步:导出成品
翻译校验完成后,支持导出为高清 PNG/JPG 图片。汉化组同学强烈建议使用 分层 PSD 导出,文本层与背景层分离,方便后续在 Photoshop 中精调字体特效。
四、踩坑排查指南
1. GPU 加速未生效
Koharu 全面支持 CUDA、ROCm、Metal 与 Vulkan。请确保显卡驱动为最新版本。CUDA 需 Turing 架构(GTX 1660+)及 R580 以上驱动。若 GPU 识别失败,系统会自动降级至 CPU,速度约慢 5-10 倍。
2. 开启调试日志
遇到报错时开启 Verbose 模式查看详细堆栈信息:
bash
## macOS / Linux
RUST_LOG=debug koharu
## Windows PowerShell
$env:RUST_LOG="debug"; koharu.exe
日志会精准指出是哪个模型加载超时或哪个管线节点崩溃,极大降低排查成本。
3. 显存溢出怎么办?
仅 6G 显存的用户建议做减法:
- Inpainting 替换为
LaMa - 翻译模型降级至
Qwen 3.5 4B - 关闭多页并行,改为单页顺序处理
4. 翻译质量不如预期?
- 优先检查 OCR 阶段:如果原文提取错误,翻译再好也是无用功。
- 调整 LLM 参数量:27B 模型在语境连贯性上显著优于小模型。显存受限时可尝试接入 OpenRouter 等聚合 API,性价比极高。
- 善用人工校对:关键对白务必在 Proofreading 阶段手动润色。
五、总结
今天我们走通了基于 Koharu 的本地漫画翻译全流程:安装部署 → 模型组合 → 管线配置 → 自动化翻译 → 成品导出。该工具的核心价值在于“数据不出本地”的安全性与“丰俭由人”的模型兼容性,从 CPU 到多卡 RTX 都能找到最佳运行策略。
后续可探索其内置的 Agent 工作流,实现多项目自动化巡检与智能调度。对 Rust 工程化感兴趣的开发者,该项目的底层架构设计同样极具参考价值。
仓库地址:github.com/koharu-rs/koharu,实战中遇到配置问题欢迎交流探讨。