Aller au contenu principal

OCR PDF

OCR PDF rend le texte d'un PDF scanné consultable par recherche et sélectionnable, en effectuant la reconnaissance de texte entièrement dans le navigateur plutôt que d'envoyer le fichier vers un serveur.

Le PDF reste sur cet appareil et est traité localement dans votre navigateur, y compris la reconnaissance de texte et la détection de langue.

Chaque page sélectionnée est rasterisée, puis lue par un moteur de reconnaissance de texte Tesseract.js local (sans envoi, sans service externe). Le résultat est du texte brut uniquement — cela ne génère pas de PDF consultable avec une couche de texte intégrée.

Limites : un PDF de 25 Mo maximum et 200 pages ; jusqu'à 10 pages peuvent être reconnues par opération, chacune rendue à environ 144 DPI, plafonnée pour rester sûre en mémoire sur mobile. Les PDF chiffrés ou protégés par mot de passe sont refusés.

Dernière vérification technique : 11 août 2026

Comment l'utiliser

  1. Sélectionnez un PDF scanné sur votre appareil et attendez la détection des pages.
  2. Choisissez de reconnaître toutes les pages ou saisissez des pages précises comme 1,3,5-8, puis sélectionnez la langue du document.
  3. Lancez la reconnaissance et attendez la fin du traitement dans le moteur Tesseract.js local.
  4. Copiez le texte reconnu ou téléchargez-le en fichier .txt.

Chaque page sélectionnée est rasterisée localement avec le même moteur de rendu PDF utilisé ailleurs dans Tooliba, puis lue par un moteur de reconnaissance de texte Tesseract.js local — le script worker, le moteur WASM et les données de langue anglais/français sont des ressources same-origin intégrées, jamais récupérées depuis un CDN. Choisissez l'anglais, le français, ou les deux avant de lancer l'opération, car la précision de reconnaissance dépend du choix des langues réelles du document ; un mauvais choix augmente le taux de caractères mal reconnus. Cette première version produit uniquement du texte brut reconnu, proposé à la copie dans le presse-papiers ou au téléchargement en fichier .txt — elle ne génère pas de nouveau PDF consultable avec une couche de texte invisible intégrée, et la précision dépend toujours de la qualité et de la résolution du scan. Aucune image ni donnée textuelle n'est envoyée à Tooliba, conservée après la session, ni incluse dans les données analytiques.

FAQ

Nous utilisons des cookies pour faire fonctionner ce site et, avec votre accord, pour comprendre son usage et personnaliser les publicités. Vous pouvez modifier votre choix à tout moment.