Ana içeriğe geç
Blog · Belge otomasyonu

Taranmış PDF belgelerini otomatik olarak sıralayın ve yeniden adlandırın.

16 Eylül 2021 · Otomatik olarak oluşturulmuş adlara ve yanlış sıralamaya sahip çok sayıda taranmış belgeniz mi var? Şimdi, PDF4me İş Akışlarını kullanarak bunları otomatik olarak sıralayın ve yeniden adlandırın.

Belge sınıflandırması, neredeyse tüm sektörlerde onlarca yıldır büyük bir zorluk teşkil etmekte ve çeşitli iş süreçlerinde çok önemli bir gerekliliğe sahiptir. Geleneksel olarak, bu süreç manuel olarak yapılmaktadır; kullanıcılar belgeyi okuyup konusunu belirleyerek belgeleri sınıflandırırlar. Manuel süreç daha doğru sınıflandırmaya yardımcı olsa da, oldukça zaman alıcı ve çok pahalıdır.

İş süreçlerinin dijitalleştirilmesi, zaman içinde önemli ölçüde manuel çabayı azaltarak ekonomilerin daha hızlı büyümesine yol açmıştır. Piyasada, iş süreçlerini daha hızlı ve kolayca ölçeklenebilir hale getirebilecek birçok belge otomasyon aracı ve hizmeti zaten mevcuttur. Bunun bir parçası olarak, iş süreçlerinize gelen büyük miktardaki belgelerin düzenlenmesi daha hızlı olmalıdır. PDF4me İş Akışı özelliği kullanılarak, sıralama ve düzenleme işlemi otomatik olarak yapılabilir.

Daha iyi anlamanız için belirli bir kullanım örneğini ele aldık.

  • Belgeden fatura numarasını normal ifadeler kullanarak bulun ve dosyayı fatura numarasıyla yeniden adlandırın; bu işlem adım adım detaylı olarak açıklanmıştır.

Belgelerinizi sıralamak, yeniden adlandırmak ve düzenli bir şekilde depolama alanına kaydetmek için 3 kolay adım.

Adım 1: OCR işlemini yalnızca gerektiğinde yapın.

OCR ile taranmış belgelerden metin tanıyın.

Bu, PDF4me'den gelen iş akışı eyleminizin ilk adımı olacaktır. PDF OCR eylemi, girdi belgenizin taranmış bir belge mi yoksa metin tabanlı bir belge mi olduğunu algılayabilen ve yalnızca gerektiğinde OCR uygulayabilen güçlü bir özelliktir. Genellikle, OCR, güçlü OCR motorları ve ilgili bileşenlerle dolu özel kaynaklar gerektirdiğinden diğer özelliklerden biraz daha maliyetlidir.

Otomasyon iş akışında, belge taranmış bir görüntü olduğunda bazen OCR'ye ihtiyaç duyabileceğiniz durumlar olabilir. Belgenizde taranmış bir görüntü yoksa ve OCR'ye gerçekten ihtiyacınız yoksa gereksiz yere ödeme yapmanıza gerek yok. İş akışınıza OCR eylemi eklerken "Gerektiğinde OCR Yap" seçeneğini etkinleştirmeniz yeterlidir. Bu eylem, dönüştürme işleminden sonra metin tabanlı bir PDF dosyası oluşturur veya dönüştürme gerekmediğinde aynı dosyayı döndürür.

Adım 2: PDF belgenizin her sayfasından metin çıkarın.

OCR ile tanıma işleminden sonra metni çıkarın.

"Metin Çıkarma" iş akışı eylemi, sayfanızın tüm içeriğini bir sonraki eylem veri bağlamına getirir. Bu, içeriğinizle istediğiniz gibi oynayabileceğiniz anlamına gelir; örneğin belirli bir metni ayrıştırmak, istediğiniz metnin bulunup bulunmadığını kontrol etmek, ayrıştırılmış metninizi özel metninizle birleştirmek ve JavaScript ifadeleriyle daha birçok şey yapmak gibi. Bu örnekte, çevrimiçi ödenmiş bir makbuzdan fatura numarasını bulmaya çalışacağız.

Örnek fatura PDF'i:

Örnek bir fatura

Bu PDF dosyasından fatura numarasını ayıklayıp, bu numarayı kullanarak dosyayı yeniden adlandıracağız ve son olarak PDF4me'nin "Belgelerim" bulut depolama alanına kaydedeceğiz.

Bu işlemin çıktı verisi içeriği, aşağıdaki formatta metin içerecektir.

${file.pages[0].PageText}

[0] - bu, sıfırdan başlayarak sayfa numarasını gösterir; PDF belgenizin herhangi bir sayfa aralığından sayfa metnini almak için bu herhangi bir sayıya ayarlanabilir.

Aşağıdaki gibi PageText veri bağlamından eşleşme bulmak için normal ifadeyi ekleyin.

${file.pages[0].PageText.match(/Invoice\s ?[#-]\s [0-9]*/g)}

Bu, veri bağlamı sonuçlarınızla birlikte düzenli ifade uygulamak için basit bir JavaScript fonksiyonudur. Bu düzenli ifade, fatura numarasını fatura etiketiyle birlikte bulmaya çalışır.

Bu şekilde, JavaScript fonksiyonlarını kullanarak belgenizi tanımlamak ve daha doğru bir şekilde sınıflandırmak için mantıksal fonksiyonlar uygulayabilir ve herhangi bir manuel çaba harcamanıza gerek kalmaz.

3. Adım: Dosyayı yeniden adlandırın ve Belge Depolama Alanıma kaydedin.

"Belgelerime Kaydet" PDF4me'nin bir işlemidir ve belgenizi PDF4me depolama alanına kaydetmenizi sağlar. Bunu Dropbox, FTP veya Google Drive'a kaydetmek isterseniz de mümkündür. Gösterim amacıyla şimdilik "Belgelerim" depolama alanını kullanıyoruz. Tüm "Kaydet" işlemlerinin bir "Çıktı Dosya Adı" alanı vardır ve bu alan zorunlu değildir.

Dosyaları özel bir adla Belgelerim'e kaydet

Dosya adınızı ${INV}-{UTCNOW()}.pdf gibi herhangi bir dinamik kombinasyonla ayarlayabilirsiniz. Bu, INV- önekiyle başlayan ve geçerli UTC saatini dinamik olarak sonuna ekleyen belgeler oluşturacaktır. Çıktı belgelerinizi nasıl ve nerede saklayacağınız konusunda kontrol sahibi olursunuz. Gösterim kullanım örneğimizde, aşağıdaki gibi yeni bir dosya adı oluşturmak için veri bağlamını normal ifadeyle birlikte yerleştirmemiz gerekiyor.

${file.pages[0].PageText.match(/Invoice\s ?[#-]\s [0-9]*/g)}.pdf

Bu üç adımı da tamamladıktan sonra belgeniz sınıflandırılacak, yeniden adlandırılacak ve istediğiniz dosya depolama konumuna kaydedilecektir. Şimdi bu sizin için ne kadar kolay, değil mi? Evet, PDF4me her zaman son kullanıcıyı göz önünde bulundurarak belge işleme dünyasında hayatlarını çok kolaylaştırıyor.

Belgelerinizi tamamlayın.

API ile ürününüze entegre edin, kod yazmadan otomatikleştirin veya tarayıcınızdaki ücretsiz araçları kullanın. Başlamak için kredi kartına gerek yok.

Tek bir aramayla başlayıncurl -X POST https://api.pdf4me.com/v1/ConvertToPdf

Ücretsiz erişim · Kredi kartı gerekmez