跳到主要内容

使用 Power Automate 进行高级图像 OCR

3 min read
PDF4me Team

我们拍摄大量包含文字的文档或表面图像,用于提取数据或供后续参考。将扫描的文档或图像转换为可搜索的PDF文件对于后续处理至关重要。实现PDF可搜索性最常用的技术是光学字符识别(OCR)。

PDF4me 提供高质量的 PDF OCR 功能,能够实现极高的文本识别准确率。但是,当您需要识别数百份扫描文档时,唯一的解决方案就是自动化。PDF4me 也提供了相应的解决方案。

PDF4me 与 Microsoft Power Apps 中的 Power Automate 结合使用,可以自动执行繁琐耗时的文档处理业务流程。PDF4me 与 Power Automate 联动,可连接各种数据源、应用和服务,轻松创建强大的工作流,实现文档处理的自动化。

如何在 Power Automate 中使用 OCR?​

让我们来看一个例子,了解如何使用 Power Automate 中的 PDF4me OCR 功能将图像转换为 PDF。假设我们在 OneDrive 中有一些文档图像或包含文本的图像,或者我们预期它们会出现在特定文件夹中。让我们将它们转换为 PDF 并进行 OCR 识别。

使用 Power Automate 的高级 PDF OCR 流程

添加 OneDrive 触发器​

Power Automate 提供多种触发器来启动您的工作流程。在本用例中,添加一个 OneDrive 触发器来启动自动化流程。

Google Drive 触发器用于 OCR 流程

添加“转换为 PDF”功能,用于文档图像​

完成触发步骤后,点击“新步骤”。此时会弹出一个包含多个应用推荐的提示,您需要搜索 PDF4me 并选择PDF4me Connect 。从操作列表中选择“转换为 PDF”操作。

将图像转换为 PDF 的操作

选择“使用 OCR 将 PDF 转换为可编辑格式”操作​

从 PDF4me 操作列表中选择 PDF OCR 。

**文件内容:**映射源 PDF 文件内容(来自上一步操作)**文件名:**映射源 PDF 文件内容(来自上一步操作)**质量类型:**选择质量类型。草稿或高

PDF4me 建议使用高质量配置文件 OCR 处理图像,以确保即使是复杂的图像也能准确识别。

PDF4me 的 PDF OCR 操作

保存 OCR 处理后的文件​

最后,在 OCR 操作之后,添加一个操作,将输出的 PDF 文件保存到所需的存储位置。在本例中,我们再次使用 OneDrive 保存操作。

将 OCR 处理后的 PDF 文件保存到 OneDrive

您还可以**在“文件名”字段中使用正则表达式(RegEx)来创建动态名称,**以便更好地对已处理的文档进行排序。

在 Power Automate 中使用正则表达式动态命名文件名

可用于 OCR 的即用模板​

为了帮助您快速上手,我们准备了一些模板供您使用。