将扫描文档或图像转换为可搜索的PDF文件对于后续文档处理至关重要。实现PDF可搜索的技术是光学字符识别(OCR)。对于企业而言,可能需要处理大量文档,这就需要实现PDF OCR的自动化。
PDF4me 提供高质量的 PDF OCR 功能,能够实现极高的文本识别准确率。但是,当您需要识别数百份扫描文档时,唯一的解决方案就是自动化。PDF4me 工作流提供了执行此自动化流程的正确方法——PDF OCR 。
如何使用工作流实现PDF OCR自动化
从扫描文档或图像创建可搜索的 PDF 文件,其中包含文本。此功能允许您从输出的 PDF 文件中搜索或复制文本。
让我们来看一个包含 PDF OCR 操作的示例工作流程。首先,从工作流程仪表板中选择**“创建工作流程”** 。
为工作流添加触发器
创建并配置一个触发器来启动工作流自动化。一旦新文件到达触发器中配置的文件夹,自动化流程就会立即启动。
我们以 Google 云端硬盘触发器为例进行说明。
添加 PDF OCR 操作
添加 ODF OCR 操作,并启用“需要时执行 OCR”,以确保仅在需要时才使用 OCR,从而节省不必要的调用。
添加保存到存储
添加保存输出文件的操作。例如,我们可以选择**“保存到 Google 云端硬盘”** 。配置处理后的文件保存到的文件夹。

配置完成后,即可保存并发布工作流。示例工作流如下所示。

