1Caricare il PDF documents scannerizzato; una scansione in scala di grigi pulita 300 DPI dà al riconoscimento il massimo con cui lavorare.
2Digli quale lingua aspettarsi che nomini il linguaggio batte lasciandolo indovinare per un ampio margine.
3Eseguire il riconoscimento pass; le parole sono scritte indietro come un livello invisibile seduto sopra l'immagine della pagina originale.
4Scarica il file ricercabile PDF {} {} } sembra identico, ma ora è possibile cercare e selezionare il testo in esso.
OCR PDF Domande frequenti
Il formato sorgente influenza il riconoscimento?
+
PDF corregge la pagina: font, vettori, immagini raster e coordinate di testo sono congelati in modo che ogni lettore vede layout identico. Come viene memorizzata la pagina decide con quali risoluzione e informazioni a colori il riconoscimento deve lavorare.
Qualcosa di specifico per PDF qui?
+
Si', un PDF è un grafico di oggetti, non un'immagine di pagina, quindi il testo rimane selezionabile e i vettori rimangono nitide non importa cosa accade al contenuto raster all'interno di esso. Colpisce cio' che il riconosciutore puo' vedere.
Come fa OCR PDF a trasformare una scansione in testo?
+
Concretamente, ogni pagina è resa, esegui un passaggio di riconoscimento testi Tesseract in oltre 100 lingue, e le parole riconosciute sono scritte indietro come un livello di testo invisibile posizionato sopra l'immagine originale κανονινισηνισηνισισισηνισησηνιση ονισισησ. La pagina appare ancora esattamente come ha fatto Hoppenstedt il testo riconosciuto si trova invisibilmente dietro l'immagine in modo da cercare e selezionare lavorare senza cambiare l'aspetto.
Quali lingue può riconoscere?
+
Oltre 100, tra cui latino, cirillico, greco, arabo, ebraico, cinese, giapponese, coreano e gli scritti indici. Raccontando quale lingua aspettarsi materialmente migliora la precisione oltre lasciando indovinare.
I segnalibri, i link e i campi di forma sopravvivono?
+
Linee di contorno, collegamenti interni e annotazioni sono conservati ovunque l'operazione lo permetta. Le firme digitali sono l'eccezione: qualsiasi modifica al file necessariamente invalida una firma, perché è proprio a questo che serve una firma.
Cosa posso caricare su OCR PDF?
+
Qualsiasi PDF standard, compresi quelli prodotti da uno scanner, da un processore di testi o da un driver di stampa. I file con una password proprietaria che limita solo l'editing vengono gestiti; i file che necessitano di una password utente per aprirsi non sono, e non tentiamo di rompere la crittografia.
C'è un limite di dimensione del file su OCR PDF?
+
Sì: Gli account gratuiti elaborano documenti fino a 25 MB ciascuno, che copre la maggior parte dei rapporti e contratti ma non un documento scansionato a lungo a 600 DPI; Ghostscript e qpdf fanno il lavoro. I PDF scansionati sono la cosa usuale che lo supera, e comprimere il documento prima è normalmente sufficiente per riportarlo sotto.
Will OCR PDF lower the quality of my PDF documents?
+
Testo e grafica vettoriale sono oggetti piuttosto che pixel, quindi rimangono perfettamente nitide in qualsiasi zoom, non importa cosa accada. Solo le immagini raster incorporate possono degradarsi, e solo se l'operazione scelta le ricampiona.
Perché un sito in formato moderno dovrebbe funzionare OCR PDF?
+
WEBP.to è costruito intorno alla sostituzione moderna per entrambi i vecchi default: un formato che fa lossy, lossless, alfa e animazione, e atterra in modo affidabile più piccolo del JPEG o PNG che è venuto da. La gente arriva qui avendo deciso che i vecchi default costano loro banda, e quella decisione aumenta immediatamente il resto: che dimensione, che qualità, che cosa accade alla trasparenza. OCR PDF è sullo stesso upload e lo stesso account in modo che a queste domande venga risposto in un unico luogo.
Una volta che OCR PDF è stato eseguito, cosa vale la pena fare ora?
+
Il convertitore su questo sito sposta le immagini da e verso WebP, PNG, JPG e AVIF, che è dove si decide se un file più piccolo vale la pena perdere i browser più vecchi. Fare in quell'ordine è importante: scegliere i pixel prima e il contenitore dopo, perché il contenitore è la decisione a buon mercato e i pixel sono quello costoso.
I siti dei fratelli gestiscono qualcosa di diverso?
+
I motori sono uguali a librerie ®, stessi lavoratori, stessi tappi. Ciò che è diverso è il parere allegato, e il parere qui si basa su una proprietà del formato che questo sito prende il nome: la stessa estensione.webp può contenere un frame VP8 lossy, uno lossless o un'animazione, quindi il percorso di elaborazione sensibile è deciso per file piuttosto che per estensione.
Cosa succede al mio file ed è richiesto un account?
+
Nessun account, e nulla viene mantenuto: gli upload vengono cancellati dai lavoratori poco dopo la fine del lavoro, e nulla viene ispezionato, elencato o indicizzato. I conti esistono solo per la storia e le dimensioni del lotto.