手把手用 Koharu 搭建本地漫画翻译流水线

32 次阅读 0 点赞 0 评论 6 分钟原创技术教程

告别云端机翻与隐私泄露。本教程带你从零配置 Koharu,掌握本地 OCR 识别、AI 翻译与排版擦除全流程。无需上传数据,一键完成漫画汉化实战。

#Rust #开源工具 #本地AI #漫画翻译 #OCR #LLM #自动化
手把手用 Koharu 搭建本地漫画翻译流水线

告别机翻尴尬:用 Koharu 搭建本地漫画翻译流水线

追生肉漫画的同学都有过这种体验:冷门佳作没人汉化,硬啃原文又卡壳。市面上的在线翻译工具不仅把图片上传云端、翻译质量参差不齐,还存在隐私泄露风险。对于带版权属性的漫画内容,这种不确定性确实让人头疼。

今天带你搭建 Koharu 本地漫画翻译工具。它基于 Rust 开发,将视觉模型和 LLM 全部部署在本地,数据绝不出门。从漫画导入、文字检测、OCR 识别、AI 翻译、原文擦除到最终排版输出,整条流水线全部在本地跑通。

学完本篇,你将独立跑通单页漫画的完整翻译流程,并学会根据硬件条件配置最合适的模型。

一、前置条件

开始实战前,请确认你的环境满足以下基础要求:

  • 操作系统:Windows 10+ / macOS(Apple Silicon)/ Linux 均可完美运行。
  • 显卡配置:NVIDIA GTX 1660 及以上(CUDA)、Apple M 系列芯片(Metal)或支持 Vulkan 的显卡。CPU 也能跑,但推理速度会显著下降。
  • 磁盘空间:模型文件体积较大,建议预留 10 GB 以上空间。
  • 编译环境(仅源码构建需要):Rust 1.97.1+、Bun 1.3.14+、LLVM 22.1.8+。

二、安装与首次启动

方案一:包管理器安装(快速上手)

Windows 用户打开 PowerShell 执行:

bash 复制代码
winget install koharu

macOS 用户确保已安装 Homebrew:

bash 复制代码
brew install --cask koharu

安装完成后,终端输入 koharu 即可唤醒图形界面。

方案二:源码编译(开发者自定义)

适合想修改默认参数或贡献代码的同学:

bash 复制代码
## 克隆仓库
git clone https://github.com/koharu-rs/koharu.git
cd koharu

## 安装前端依赖并构建
bun install
bun run build

编译完成后,Release 产物位于 target/release 目录。

模型选型指南

首次运行时,Koharu 会引导下载核心模型。根据你的硬件和翻译语种,建议按以下策略搭配:

  1. 检测与分割模型:推荐 Koharu Layout RF-DETR Seg 2XL,文字区域与气泡框线识别准确率最高。
  2. OCR 模型:日文漫画首选 Baberu OCRHayai OCR;需要多语言覆盖选 PaddleOCR VL 1.6
  3. Inpainting 模型FLUX.2 Klein 背景修补最细腻,但吃显存;LaMa 轻量快速,是低配环境的救星。
  4. 翻译引擎(LLM):本地运行推荐 Qwen 3.5 9B(GGUF 格式),12G 显存可流畅运行。追求极致质量可上 Qwen 3.5 27BGemma 4 26B。网络通畅时也可接入 OpenAI 或 Claude API。

三、实战:翻译一页漫画

配置好环境后,我们拿一页实际漫画跑通整条管线。

第一步:创建项目

启动 Koharu 主界面,点击 New Project。支持拖入单张 PNG/JPG、ZIP/CBZ 压缩包(自动按文件名排序)或 PDF 文件。导入后系统会自动为页面编号。

第二步:配置处理管线

在项目设置面板,按需开启各处理节点:

  • Detection:开启气泡与文字区域定位
  • OCR:执行文字图像转文本
  • Translation:设定源语言(通常为日语)与目标语言,绑定 LLM 或云端 API
  • Inpainting:开启原文擦除与背景智能填充
  • Typesetting:开启排版。强烈建议勾选“竖排中文/从右到左布局”,完美契合漫画阅读习惯。

所有步骤均支持单页级或全局级独立开关。例如某页为无文字封面,可直接跳过检测环节。

第三步:执行翻译

点击 Process,Koharu 将按预设顺序自动化执行:检测 → OCR → LLM 翻译 → 擦除 → 排版。
处理全程支持在 WebGPU 画布实时预览。遇到机翻生硬的地方,可随时暂停进入 Proofreading(校对)阶段人工修正台词。

第四步:导出成品

翻译校验完成后,支持导出为高清 PNG/JPG 图片。汉化组同学强烈建议使用 分层 PSD 导出,文本层与背景层分离,方便后续在 Photoshop 中精调字体特效。

四、踩坑排查指南

1. GPU 加速未生效

Koharu 全面支持 CUDA、ROCm、Metal 与 Vulkan。请确保显卡驱动为最新版本。CUDA 需 Turing 架构(GTX 1660+)及 R580 以上驱动。若 GPU 识别失败,系统会自动降级至 CPU,速度约慢 5-10 倍。

2. 开启调试日志

遇到报错时开启 Verbose 模式查看详细堆栈信息:

bash 复制代码
## macOS / Linux
RUST_LOG=debug koharu

## Windows PowerShell
$env:RUST_LOG="debug"; koharu.exe

日志会精准指出是哪个模型加载超时或哪个管线节点崩溃,极大降低排查成本。

3. 显存溢出怎么办?

仅 6G 显存的用户建议做减法:

  • Inpainting 替换为 LaMa
  • 翻译模型降级至 Qwen 3.5 4B
  • 关闭多页并行,改为单页顺序处理

4. 翻译质量不如预期?

  • 优先检查 OCR 阶段:如果原文提取错误,翻译再好也是无用功。
  • 调整 LLM 参数量:27B 模型在语境连贯性上显著优于小模型。显存受限时可尝试接入 OpenRouter 等聚合 API,性价比极高。
  • 善用人工校对:关键对白务必在 Proofreading 阶段手动润色。

五、总结

今天我们走通了基于 Koharu 的本地漫画翻译全流程:安装部署 → 模型组合 → 管线配置 → 自动化翻译 → 成品导出。该工具的核心价值在于“数据不出本地”的安全性与“丰俭由人”的模型兼容性,从 CPU 到多卡 RTX 都能找到最佳运行策略。

后续可探索其内置的 Agent 工作流,实现多项目自动化巡检与智能调度。对 Rust 工程化感兴趣的开发者,该项目的底层架构设计同样极具参考价值。

仓库地址:github.com/koharu-rs/koharu,实战中遇到配置问题欢迎交流探讨。

最后更新:2026-09-08T10:02:19

评论 (0)

发表评论

blog.comments.form.loading
0/500
加载评论中...