Plan gratuit: 1 conversion/heure, 1 fichier à la fois
Aller sans limite →

OCR PDF

Gratuit en ligne PDF OCR

Sélectionnez vos fichiers

*Fichiers supprimés après 24 heures

Convertissez gratuitement des fichiers jusqu'à 1 Go. Les utilisateurs Pro peuvent convertir des fichiers jusqu'à 100 Go. Inscrivez-vous dès maintenant !

Téléchargement

0%

Comment faire pour OCR PDF

1 Téléchargez le scan PDF documents; un scan à échelle grise de 300 DPI propre donne au reconnu le plus à travailler avec.
2 Dites-lui quelle langue vous pouvez attendre — en donnant le nom de la langue, vous la laissez deviner par une large marge.
3 Exécutez le passe de reconnaissance; les mots sont réécrits comme une couche invisible assise sur l'image de page originale.
4 Télécharger le fichier de recherche PDF — il semble identique, mais vous pouvez maintenant rechercher et sélectionner le texte dans celui-ci.

OCR PDF FAQ

Le format source a-t-il une incidence sur la reconnaissance?
+
Il le fait. PDF corrige la page : polices, vecteurs, images raster et coordonnées de texte sont gelés afin que chaque lecteur voit la mise en page identique. Comment la page est stockée décide avec quelle résolution et quelle couleur l'information du reconnu doit fonctionner.
Oui — un PDF est un graphique objet, pas une image de page, donc le texte reste sélectionnable et les vecteurs restent pointus, peu importe ce qui arrive au contenu raster à l'intérieur. Cela affecte ce que le reconnu peut voir.
Concrètement, chaque page est rendue, passe par un passage de reconnaissance texte Tesseract dans plus de 100 langues, et les mots reconnus sont réécrits comme une couche de texte invisible positionnée sur l'image originale.. La page ressemble toujours exactement à elle — le texte reconnu se trouve invisiblement derrière l'image ainsi la recherche et la sélection fonctionnent sans changer l'apparence.
Plus de 100, y compris le latin, le cyrillique, le grec, l'arabe, l'hébreu, le chinois, le japonais, le coréen et les scripts Indic.
Les lignes directrices, les liens internes et les annotations sont conservés partout où l'opération le permet. Les signatures numériques sont l'exception : toute modification du fichier invalide nécessairement une signature, car c'est précisément pour cela qu'une signature est signée.
Tout PDF standard, y compris ceux produits par un scanner, par un processeur de texte ou par un pilote d'impression. Les fichiers avec un mot de passe propriétaire qui limite uniquement l'édition sont traités; les fichiers qui ont besoin d'un mot de passe utilisateur pour ouvrir ne sont pas, et nous ne essayons pas de briser le chiffrement.
Oui : les comptes libres traitent les documents jusqu'à 5 MB chacun, qui couvre la plupart des rapports et des contrats mais pas un long document scanné à 600 DPI; Ghostscript et qpdf font le travail. Les PDF numérisés sont la chose habituelle qui dépasse le document, et la compression du document d'abord suffit normalement pour le ramener sous.
Les œuvres texte et vectoriel sont des objets plutôt que des pixels, donc ils restent parfaitement pointus à n'importe quel zoom, peu importe ce qui se passe. Seules les images raster intégrées peuvent se dégrader, et seulement si l'opération que vous avez choisie les résample.
WEBP.to est construit autour du remplacement moderne pour les deux anciens défauts : un format qui fait perte, perte, alpha et animation, et se trouve de manière fiable plus petit que le JPEG ou PNG dont il est issu. Les gens arrivent ici après avoir décidé que les anciens par défaut leur coûtent de la bande passante, et cette décision soulève immédiatement le reste: quelle taille, quelle qualité, ce qui arrive à la transparence. OCR PDF est sur le même téléchargement et le même compte afin que ces questions obtiennent réponse en un seul endroit.
Le convertisseur sur ce site déplace des images vers et depuis WebP, PNG, JPG et AVIF, qui est où vous décidez si un fichier plus petit vaut la peine de perdre les navigateurs plus anciens. Le faire dans cet ordre est important: choisissez les pixels d'abord et le conteneur après, parce que le conteneur est la décision bon marché et les pixels sont le cher.
Les moteurs sont identiques — mêmes bibliothèques, mêmes travailleurs, mêmes capsules. Ce qui est différent est l'opinion jointe, et l'opinion repose ici sur une propriété du format de ce site est nommé d'après: la même extension.webp peut contenir un cadre VP8 lossy, un sans perte, ou une animation, de sorte que le chemin de traitement raisonnable est décidé par fichier plutôt que par extension.
Aucun compte, et rien n'est retenu : les téléchargements sont supprimés des travailleurs peu après la fin du travail, et rien n'est inspecté, répertorié ou indexé.

Évaluer cet optimisation
5.0/5 - 0 voix
ns6.com — Votre domaine, fait droit. Confidentialité gratuite et DNS inclus.
Ou placez vos fichiers ici