Aller au contenu principal

Réglages → OCR

Les PDF scannés et les images n'ont pas de couche texte : sans lecteur, ils restent hors de votre mémoire. Cette page en installe un. L'entrée du rail s'appelle OCR ; la page est titrée OCR — documents scannés et son sous-titre dit Lisez le texte des PDF scannés et des images. Choisissez un moteur et installez-le une fois — il tourne en local.

Chaque contrôle de cette page agit dès le clic. Il n'y a pas de bouton Enregistrer.

Pour ce qui arrive à un document scanné une fois un moteur en place, voir OCR. Cette page parle des réglages.

Moteur OCR

La section s'ouvre sur Chargement des moteurs…. Si la liste ne se lit pas : Impossible de charger les moteurs OCR. et un bouton Réessayer.

Deux moteurs existent. Leurs noms sont en anglais dans toutes les langues.

MoteurLa note de l'appGPUPorte
RapidOCR (light)Léger — rapide, ~200 Mo, sans GPU. Idéal pour les PDF courants.nongratuit ; le moteur actif par défaut
MinerU (power, GPU)Puissance — précision maximale (mise en page, tableaux), GPU, gros téléchargement.ouilicence Engramm

Chaque ligne est un bouton radio : la cliquer fait de ce moteur le moteur actif, mais seulement une fois installé. La ligne montre une icône CPU ou ⚡, le nom, et · Actif sur le moteur en service.

Sur le moteur GPU, une ligne de licence suit la note dès que l'app a la réponse (rien ne s'affiche avant) : · ⚡ Licence Engramm détectée — pleine puissance débloquée ou · 🔒 Licence Engramm requise — débloque l'OCR haute précision : mise en page, tableaux et formules restitués intacts.

  • Non installé : un bouton Installer. Pendant l'opération, le bouton compte Installation 40% avec une barre de progression et l'étape en cours : Préparation de l'environnement, Installation des dépendances, Téléchargement du runtime GPU, Installation du moteur OCR, Téléchargement des modèles OCR, Finalisation. L'installation tourne en arrière-plan et survit au changement de page. Une installation réussie rend le moteur actif.
  • Installé : ✓ Prêt, un bouton Tester et un bouton Supprimer. Tester (Test en cours…) ouvre une boîte de dialogue de fichier (PDF, PNG, JPG, TIFF, WebP, BMP) et imprime le texte brut sous la ligne dans un encadré titré Résultat OCR, plafonné à 5 000 caractères, ou Aucun texte détecté sur ce document. Supprimer désinstalle le moteur sans confirmation.
La ligne ditPourquoi
Une autre installation est déjà en cours — attendez qu'elle se termine.Une seule installation à la fois.
Nécessite une licence Engramm.Le moteur GPU a été demandé sans licence.
Ça a échoué sans dire pourquoi.L'installation a échoué sans message.

Tout autre échec montre son message tel quel.

Licence Engramm

MinerU fait partie de la licence Engramm. Le cadenas sur la ligne est un aperçu ; le refus se produit dans le moteur lui-même, qui ne s'installera ni ne lira une page sans la licence. Le moteur léger est gratuit et suffit aux PDF de tous les jours.

La première installation du moteur GPU est longue

MinerU installe d'abord le runtime GPU (l'étape Téléchargement du runtime GPU), et ses modèles ne descendent qu'au premier scan qu'il lit. Les deux moteurs demandent Python 3.10 ou plus récent sur la machine.

Lire ce qu'un scan cache

Sans licence, et parce qu'un moteur GPU existe, une carte se tient sous les moteurs : Lire ce qu'un scan cache. Une licence Engramm débloque le moteur GPU : tes livres scannés, actes et archives reviennent en texte que ta mémoire peut vraiment chercher — mise en page, tableaux et formules compris. Une licence, pas d'abonnement. Le bouton d'achat en dessous est le vrai, celui du portefeuille ; quand rien n'est en vente, que la machine est hors ligne ou qu'il n'y a pas de portefeuille, il ne rend rien plutôt qu'un bouton mort.

Les PDF scannés en attente

Quand les vaults contiennent des PDF scannés que personne ne sait lire, une ligne avec un sablier les compte : n PDF scannés dans tes vaults ne sont PAS indexés — ils n'ont pas de couche texte et aucun moteur ne peut les lire. Ils seront lus automatiquement dès qu'un moteur sera installé. Elle disparaît une fois qu'ils sont lus.

La ligne du bas

Les PDF avec couche texte fonctionnent déjà sans OCR. N'installez un moteur que pour lire les PDF scannés ou images. · Nécessite Python 3.10+.

Pièges

  • Le moteur GPU refuse de s'installer et de lire sans licence Engramm ; le cadenas de la liste ne fait que l'annoncer.
  • Installer un moteur demande un Python système 3.10 ou plus récent.
  • Supprimer ne demande rien. Le compteur de PDF en attente est la façon de voir ce qui reste non indexé en silence.