Piano libero: 1 conversione/ora, 1 file alla volta
Vai illimitato →

OCR PDF

Estrarre testo da PDF scansionati

Seleziona i tuoi file

*File eliminati dopo 24 ore

Converti gratuitamente file fino a 1 GB, gli utenti Pro possono convertire file fino a 100 GB; registrati ora

Caricamento in corso

0%

Come OCR PDF

1 Caricare il PDF documents scannerizzato; una scansione in scala di grigi pulita 300 DPI dà al riconoscimento il massimo con cui lavorare.
2 Digli quale lingua aspettarsi che nomini il linguaggio batte lasciandolo indovinare per un ampio margine.
3 Eseguire il riconoscimento pass; le parole sono scritte indietro come un livello invisibile seduto sopra l'immagine della pagina originale.
4 Scarica il file ricercabile PDF {} {} } sembra identico, ma ora è possibile cercare e selezionare il testo in esso.

OCR PDF Domande frequenti

Il formato sorgente influenza il riconoscimento?
+
PDF corregge la pagina: font, vettori, immagini raster e coordinate di testo sono congelati in modo che ogni lettore vede layout identico. Come viene memorizzata la pagina decide con quali risoluzione e informazioni a colori il riconoscimento deve lavorare.
Si', un PDF è un grafico di oggetti, non un'immagine di pagina, quindi il testo rimane selezionabile e i vettori rimangono nitide non importa cosa accade al contenuto raster all'interno di esso. Colpisce cio' che il riconosciutore puo' vedere.
Concretamente, ogni pagina è resa, esegui un passaggio di riconoscimento testi Tesseract in oltre 100 lingue, e le parole riconosciute sono scritte indietro come un livello di testo invisibile posizionato sopra l'immagine originale κανονινισηνισηνισισισηνισησηνιση ονισισησ. La pagina appare ancora esattamente come ha fatto Hoppenstedt il testo riconosciuto si trova invisibilmente dietro l'immagine in modo da cercare e selezionare lavorare senza cambiare l'aspetto.
Oltre 100, tra cui latino, cirillico, greco, arabo, ebraico, cinese, giapponese, coreano e gli scritti indici. Raccontando quale lingua aspettarsi materialmente migliora la precisione oltre lasciando indovinare.
Linee di contorno, collegamenti interni e annotazioni sono conservati ovunque l'operazione lo permetta. Le firme digitali sono l'eccezione: qualsiasi modifica al file necessariamente invalida una firma, perché è proprio a questo che serve una firma.
Qualsiasi PDF standard, compresi quelli prodotti da uno scanner, da un processore di testi o da un driver di stampa. I file con una password proprietaria che limita solo l'editing vengono gestiti; i file che necessitano di una password utente per aprirsi non sono, e non tentiamo di rompere la crittografia.
Sì: Gli account gratuiti elaborano documenti fino a 25 MB ciascuno, che copre la maggior parte dei rapporti e contratti ma non un documento scansionato a lungo a 600 DPI; Ghostscript e qpdf fanno il lavoro. I PDF scansionati sono la cosa usuale che lo supera, e comprimere il documento prima è normalmente sufficiente per riportarlo sotto.
Testo e grafica vettoriale sono oggetti piuttosto che pixel, quindi rimangono perfettamente nitide in qualsiasi zoom, non importa cosa accada. Solo le immagini raster incorporate possono degradarsi, e solo se l'operazione scelta le ricampiona.
WEBP.to è costruito intorno alla sostituzione moderna per entrambi i vecchi default: un formato che fa lossy, lossless, alfa e animazione, e atterra in modo affidabile più piccolo del JPEG o PNG che è venuto da. La gente arriva qui avendo deciso che i vecchi default costano loro banda, e quella decisione aumenta immediatamente il resto: che dimensione, che qualità, che cosa accade alla trasparenza. OCR PDF è sullo stesso upload e lo stesso account in modo che a queste domande venga risposto in un unico luogo.
Il convertitore su questo sito sposta le immagini da e verso WebP, PNG, JPG e AVIF, che è dove si decide se un file più piccolo vale la pena perdere i browser più vecchi. Fare in quell'ordine è importante: scegliere i pixel prima e il contenitore dopo, perché il contenitore è la decisione a buon mercato e i pixel sono quello costoso.
I motori sono uguali a librerie ®, stessi lavoratori, stessi tappi. Ciò che è diverso è il parere allegato, e il parere qui si basa su una proprietà del formato che questo sito prende il nome: la stessa estensione.webp può contenere un frame VP8 lossy, uno lossless o un'animazione, quindi il percorso di elaborazione sensibile è deciso per file piuttosto che per estensione.
Nessun account, e nulla viene mantenuto: gli upload vengono cancellati dai lavoratori poco dopo la fine del lavoro, e nulla viene ispezionato, elencato o indicizzato. I conti esistono solo per la storia e le dimensioni del lotto.

Valuta questo strumento
5.0/5 - 0 voti
ns6.com • Acquista il tuo dominio in pochi minuti. Cerca, registrati, lancia.
O posizionare i file qui