Lewati ke konten utama
Blog · Otomatisasi dokumen

Mengurutkan dan mengganti nama dokumen PDF yang dipindai secara otomatis.

16 September 2021 · Memiliki banyak dokumen hasil pindaian dengan nama yang dihasilkan mesin dan pengurutan yang tidak tepat. Sekarang, urutkan dan ganti nama dokumen tersebut secara otomatis menggunakan Alur Kerja PDF4me.

Klasifikasi dokumen merupakan tantangan besar selama beberapa dekade di hampir semua industri, dan memiliki kebutuhan yang sangat penting dalam berbagai proses bisnis. Secara tradisional, proses ini dilakukan secara manual, seperti pengguna membaca dokumen dan mengidentifikasi subjek untuk mengklasifikasikan dokumen. Meskipun proses manual membantu pengkategorian yang lebih tepat, proses ini sangat memakan waktu dan sangat mahal.

Digitalisasi proses bisnis telah mengurangi upaya manual secara signifikan dari waktu ke waktu, yang menghasilkan pertumbuhan ekonomi yang lebih cepat. Terdapat banyak alat dan layanan otomatisasi pekerjaan dokumen yang sudah tersedia di pasaran yang dapat mempermudah proses bisnis agar lebih cepat dan mudah diskalakan. Sebagai bagian dari hal ini, pengorganisasian dokumen dalam jumlah besar yang masuk ke dalam proses bisnis Anda perlu dilakukan dengan lebih cepat. Proses penyortiran dan pengorganisasian dapat dilakukan secara otomatis dengan fitur pendukung menggunakan fitur Alur Kerja PDF4me .

Untuk pemahaman yang lebih baik, kami telah mengambil contoh kasus spesifik.

  • Cara menemukan nomor faktur dari dokumen menggunakan ekspresi reguler dan mengganti nama file dengan nomor faktur, dijelaskan langkah demi langkah secara detail.

3 Langkah Mudah untuk mengurutkan dokumen Anda, mengganti namanya, dan menyimpannya ke penyimpanan yang tertata rapi.

Langkah 1: Lakukan OCR hanya jika diperlukan

Mengenali teks dari dokumen yang dipindai dengan OCR.

Ini akan menjadi langkah pertama dari alur kerja Anda di PDF4me. Fitur OCR PDF adalah fitur yang ampuh, yang dapat mendeteksi apakah dokumen input Anda adalah dokumen hasil pemindaian atau dokumen berbasis teks, dan menerapkan OCR hanya jika diperlukan. Biasanya, OCR sedikit lebih mahal daripada fitur lainnya karena melibatkan sumber daya khusus yang dilengkapi dengan mesin OCR yang canggih dan komponen terkait.

Dalam alur kerja otomatisasi, mungkin ada situasi di mana Anda terkadang memerlukan OCR ketika dokumen berupa gambar hasil pemindaian. Anda tidak perlu membayar secara tidak perlu jika Anda tidak benar-benar perlu menerapkan OCR saat dokumen Anda tidak memiliki gambar hasil pemindaian. Cukup aktifkan opsi "Lakukan OCR Saat Diperlukan" saat menambahkan tindakan OCR dalam alur kerja Anda. Tindakan ini menghasilkan file PDF berbasis teks setelah konversi atau mengembalikan file yang sama jika tidak memerlukan konversi.

Langkah 2: Ekstrak teks dari setiap halaman dokumen PDF Anda

Ekstrak teks setelah dikenali dengan OCR.

Aksi alur kerja Ekstrak Teks akan membawa semua konten halaman Anda ke konteks data aksi berikutnya. Ini berarti Anda dapat memanipulasi konten Anda sesuka hati - seperti mengurai teks tertentu, memeriksa apakah teks yang Anda inginkan ditemukan, menggabungkan teks yang diurai dengan teks kustom Anda, dan banyak lagi dengan ekspresi JavaScript. Dalam contoh ini, kita akan mencoba menemukan nomor faktur dari tanda terima pembayaran online.

Contoh faktur PDF:

Contoh faktur

Dari berkas PDF ini, kita ingin mengambil nomor faktur dan menggunakan nomor ini kita akan mengganti nama berkas dan menyimpannya di penyimpanan cloud My Docs milik PDF4me.

Konteks data keluaran dari tindakan ini akan berisi teks dalam format di bawah ini.

${file.pages[0].PageText}

[0] - ini menunjukkan nomor halaman yang dimulai dari nol, ini dapat diatur ke angka berapa pun untuk mendapatkan teks halaman dari rentang halaman mana pun di dokumen PDF Anda.

Tambahkan ekspresi reguler untuk menemukan kecocokan dari konteks data PageText seperti di bawah ini.

${file.pages[0].PageText.match(/Invoice\s ?[#-]\s [0-9]*/g)}

Ini adalah fungsi JavaScript sederhana untuk menerapkan ekspresi reguler bersama dengan hasil konteks data Anda. Ekspresi reguler ini mencoba menemukan nomor faktur beserta label Faktur.

Dengan cara ini, Anda dapat memanfaatkan fungsi JavaScript untuk menerapkan fungsi logika apa pun guna mengidentifikasi dokumen Anda dan membuat keputusan untuk mengklasifikasikannya dengan lebih akurat dan tanpa upaya manual.

Langkah 3: Ganti nama dan simpan ke Penyimpanan Dokumen Saya

Save To MyDoc adalah aksi PDF4me yang memungkinkan Anda menyimpan dokumen Anda di penyimpanan PDF4me. Jika Anda ingin menyimpannya di Dropbox, FTP, atau Google Drive juga dimungkinkan. Untuk tujuan demonstrasi, kami menggunakan penyimpanan My Docs untuk saat ini. Semua aksi simpan ke memiliki Output Filename, yang merupakan bidang opsional.

Simpan file dengan nama khusus ke Dokumen Saya.

Anda dapat mengatur nama file kustom Anda dengan kombinasi dinamis apa pun seperti ${INV}-{UTCNOW()}.pdf - Ini akan menghasilkan dokumen dengan awalan INV- dan akhiran waktu UTC saat ini secara dinamis. Anda mendapatkan kendali atas apa, bagaimana, dan di mana dokumen keluaran Anda akan disimpan. Dalam kasus penggunaan demonstrasi kami, kami perlu menempatkan konteks data bersama dengan ekspresi reguler untuk menghasilkan nama file baru seperti di bawah ini.

${file.pages[0].PageText.match(/Invoice\s ?[#-]\s [0-9]*/g)}.pdf

Setelah menjalankan ketiga langkah ini, dokumen Anda akan diklasifikasikan, diganti namanya, dan disimpan di lokasi penyimpanan file yang Anda inginkan. Mudah bukan? Ya, PDF4me selalu berpikir dari perspektif pengguna akhir dan membuat hidup mereka sangat mudah dalam dunia pemrosesan dokumen.

Selesaikan dokumen Anda.

Integrasikan ke dalam produk Anda dengan API, otomatiskan tanpa perlu menulis kode, atau gunakan alat gratis di browser Anda. Tidak perlu kartu kredit untuk memulai.

Mulailah dengan satu panggilancurl -X POST https://api.pdf4me.com/v1/ConvertToPdf

Tingkat gratis · Tidak memerlukan kartu kredit