扫描件翻译
扫描件的文字不是文字,是图。复制粘贴不了,普通翻译工具也读不到——这就是为什么把一份影印的旧档案丢进翻译框往往什么都不出来。
格译对这类文件先做识别再翻译:把图里的字读出来、理清阅读顺序、然后翻译并重新排版。多栏页面按栏还原而不是揉成一团,竖排会转成横排。
哪些原件属于这一类
- 扫描的书页与影印档案——用扫描仪或复印机产出的 PDF。
- 手机拍的文档照片——PNG、JPEG、WEBP、TIFF 等图片格式。
- 只有图像层的 PDF——在阅读器里选不中任何文字的那种。
- 版面复杂的旧出版物——多栏、竖排、跨页排版。
什么情况下识别得最准
印刷清晰、扫描端正的版面识别率最高。图像模糊、倾斜、光照不均,或者手写体较多时,识别难度明显上升——这类文件建议导出前对着原件过一遍关键段落。
竖排日文、見開き这类阅读顺序特殊的版式会自动纠正,不用自己拆页或调整顺序。
只想要原文,不要译文
如果你要的只是把扫描件里的字抠出来、不需要翻译,用文档提取更合适:它按页收 4 积分,产出 Word、PDF、TXT 或 Markdown 的横排可编辑文本,原文是什么语言出来还是什么语言。
先提取、确认识别质量之后再决定要不要翻译,也是一种省积分的做法。
常见问题
扫描件翻译多少积分?
扫描件走 AI 重排的识别路径:高精度 8 积分一页、标准 4 积分一页,每个文件最低 10 积分。单张图片按一页计算。
为什么比普通 PDF 贵?
扫描件要先经过文字识别才能翻译,这一步的算力成本明显高于直接读文字层。文字层完整的电子版 PDF 走原版保留只要 4 积分一页。
多栏排版会被读乱吗?
不会。多栏页面按阅读顺序还原,而不是从左到右横扫成一大团。
手写的能识别吗?
印刷体的识别率明显高于手写体。手写内容较多时,结果需要人工核对,建议先用文档提取看一遍识别质量。
翻完的成品是什么格式?
扫描件走 AI 重排,可导出 Word、PDF、Markdown 或 EPUB。注意它不是把译文贴回原图,而是重排成可编辑的文档。
一张图片也要收 10 积分吗?
是。单文件最低收 10 积分,一张图片按一页算。多张图片可以合并成一个 PDF 再上传,按总页数计费更划算。
相关内容
English version
Geyi is a proprietary AI document platform owned and operated by Nayuta Technology and Culture Company Limited.