跳到主要内容

使用 PDF4me 工作流程通过 PDF OCR 识别文本

2 min read
PDF4me Team

将扫描文档或图像转换为可搜索的PDF文件对于后续文档处理至关重要。实现PDF可搜索的技术是光学字符识别(OCR)。对于企业而言,可能需要处理大量文档,这就需要实现PDF OCR的自动化。

PDF4me 提供高质量的 PDF OCR 功能,能够实现极高的文本识别准确率。但是,当您需要识别数百份扫描文档时,唯一的解决方案就是自动化。PDF4me 工作流提供了执行此自动化流程的正确方法——PDF OCR 。

如何使用工作流实现PDF OCR自动化​

从扫描文档或图像创建可搜索的 PDF 文件,其中包含文本。此功能允许您从输出的 PDF 文件中搜索或复制文本。

让我们来看一个包含 PDF OCR 操作的示例工作流程。首先,从工作流程仪表板中选择**“创建工作流程”** 。

创建新的工作流界面

为工作流添加触发器​

创建并配置一个触发器来启动工作流自动化。一旦新文件到达触发器中配置的文件夹,自动化流程就会立即启动。

我们以 Google 云端硬盘触发器为例进行说明。

Google Drive 触发器用于 PDF OCR 自动化

添加 PDF OCR 操作​

添加 ODF OCR 操作,并启用“需要时执行 OCR”,以确保仅在需要时才使用 OCR,从而节省不必要的调用。

来自 PDF4me 工作流程的 PDF OCR 操作

添加保存到存储​

添加保存输出文件的操作。例如,我们可以选择**“保存到 Google 云端硬盘”** 。配置处理后的文件保存到的文件夹。

PDF4me 工作流的“保存到 Google 云端硬盘”操作

配置完成后,即可保存并发布工作流。示例工作流如下所示。

PDF OCR 示例自动化工作流程