对照文档翻译器产品系统

我要开发同款
WangQiang2332026年10月12日
3阅读

技术信息

语言技术
Python、QT、Torch
系统类型
MacOS、Windows、Linux
行业分类
人工智能、项目任务
参考价格
50

作品详情

行业场景

面向科研学习与学术文献阅读场景,帮助需要精读外文论文的学生和研究者减少在 PDF、OCR 工具、翻译页面之间反复切换的操作。阅读扫描版或包含图文内容的论文时,可针对页面中的段落、公式说明或图表区域进行局部识别与翻译,并保留原文和译文的对应关系,便于理解、复习和整理。项目源于学生时代对照阅读论文的实际需求,也用于实践 OCR、模块化架构与桌面应用开发。

功能介绍

1. 支持打开本地 PDF,也可通过 URL 下载 PDF;将文档页面渲染后在桌面界面中预览。
2. 可在页面上创建、移动和调整区域框,选择需要处理的文字或图文区域;保留区域位置及页面信息。
3. 提供可配置的处理流水线:裁剪图像、调用 Tesseract OCR 识别文字、按段落或句子整理识别结果,并处理断行连字符。
4. 可接入 Google 翻译 API 或 Google Apps Script 翻译节点,设置源语言、目标语言及分批字符数,并显示处理进度。
5. 将区域图片、原文和译文组合生成 HTML 对照页面;可选择图片格式、内嵌样式与图片、保存原始 PDF,并在导出后打开结果。

项目实现

使用 Python 与 PyQt6 构建桌面程序,按 Model、View、Controller 和 Listener 分层组织。通过 PipelineNode 定义处理节点及输入/输出端口,用户可在界面中配置节点并连接数据流;节点通过文档树上的处理缓存传递结果。项目以 Hub 传递宿主和模块依赖,并扫描 I/O、流水线和监听器基类的实现类,形成轻量 IoC 与插件式扩展机制。事件监听器使用队列配合 Qt 定时回调处理 UI 更新和流水线任务。实现中的重点是把可视化选区映射到 PDF 页面坐标,并让 OCR、文本整理、翻译和 HTML 导出按节点顺序协作;翻译请求按字符上限分批,同时更新进度并处理 Qt 事件。

示例图片

声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!
下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

评论