[{"data":1,"prerenderedAt":61},["ShallowReactive",2],{"docs-zh-/zh/docs/translator/translate-scanned-pdf":3},{"id":4,"title":5,"body":6,"description":53,"extension":54,"meta":55,"navigation":56,"path":57,"seo":58,"stem":59,"__hash__":60},"docs_zh/zh/docs/translator/translate-scanned-pdf.md","扫描件翻译",{"type":7,"value":8,"toc":48},"minimark",[9,12,16,19,26,30,38,45],[10,11,5],"h1",{"id":5},[13,14,15],"p",{},"Doco Translate 内置 OCR，支持扫描件 PDF 的解析与翻译",[13,17,18],{},"扫描件 PDF 是指通过扫描生成的 PDF 文件，扫描件文档中的每页的内容通常以图片形式存储，没有标准的文本内容结构，所以无法直接从文档中获取文本内容进行翻译，需要使用 OCR 技术识别并提取文本内容，再进行翻译",[13,20,21],{},[22,23],"img",{"alt":24,"src":25},"扫描件 OCR 翻译","/images/docs/scanned-pdf-ocr.webp",[27,28,29],"h2",{"id":29},"注意事项",[13,31,32,33,37],{},"扫描件翻译由于使用的视觉方案识别并提取文本，没有原始文本信息作为语言判断依据，当源语言选择 ",[34,35,36],"strong",{},"自动检测"," 时，可能会出现识别和提取文本内容不准确的情况",[13,39,40,41,44],{},"对于扫描件文档，最佳实践是 ",[34,42,43],{},"手动指定源语言","，指定正确的源语言可以保证文本解析和提取的准确性",[13,46,47],{},"Doco Translate 在识别到是扫描件文档时，也会主动提示用户手动指定源语言，以保证 OCR 的准确性和翻译效果",{"title":49,"searchDepth":50,"depth":50,"links":51},"",2,[52],{"id":29,"depth":50,"text":29},"使用 Doco Translate 内置 OCR 解析和翻译扫描件 PDF。","md",{},true,"/zh/docs/translator/translate-scanned-pdf",{"title":5,"description":53},"zh/docs/translator/translate-scanned-pdf","144K8QNisMx8Z0xdUAZFxAjMyHpOV02Mn2VBjAB1BiM",1787207636127]