Compte gratuit · 0 AI Deep Detect à vie · UE Frankfurt

Extraire le texte d'un PDF

Extraire le texte de tout PDF (scan inclus) en .txt ou .docx : OCR Tesseract 5 LSTM 80+ langues, hébergé UE Frankfurt RGPD, sans envoi Google Vision ni AWS.

Voir les tarifs
100% gratuit pour usage léger Hébergé en UE Compte gratuit requis

Comment ça marche

1

Importer le PDF

Glissez votre fichier. Si c'est un scan, l'OCR commence automatiquement.

2

Choisir le format

.txt brut, .docx avec mise en forme, ou copier directement le texte.

3

Télécharger

Texte propre, prêt à indexer, traduire ou archiver.

Pourquoi choisir iFillPDF

OCR Tesseract 5 LSTM — 80+ langues

Moteur Tesseract 5 (Apache 2.0) avec réseau neuronal LSTM entraîné sur plus de 80 langues dont français, anglais, espagnol, allemand, italien, portugais, arabe (RTL), hébreu, chinois simplifié et traditionnel, japonais…

Structure préservée — export .txt + .docx

Sortie en .txt brut Unicode UTF-8 pour indexation/scripts ou .docx Microsoft Word 2016+ avec titres H1-H6, paragraphes, listes à puces, tableaux et césures préservés grâce à notre analyse de mise en page (PDF.…

Archivage PDF/A — preuve légale

Export d'un PDF consultable PDF/A-1b, PDF/A-2u ou PDF/A-3a (normes ISO 19005) couplant l'image originale et le texte OCR caché — recevable en justice au titre de l'article 1366 du Code civil (force probante) et conforme à…

Hébergement UE Frankfurt — zéro Big Tech

Traitement OCR sur serveurs Hetzner Frankfurt eu-central-1 (anti-arrêt CJUE Schrems II C-311/18), aucun envoi à OpenAI, Anthropic, Google Cloud Vision, AWS Textract, Azure AI Document Intelligence. Chiffrement AES-256 + TLS 1.…

Un document à la fois, sans limite quotidienne

iFillPDF traite un PDF à la fois : il n'y a pas de file d'attente multi-fichiers ni de traitement par lots, contrairement à ce que promet Adobe Acrobat Pro (19,99 €/mois) pour l'OCR en série.…

Détails techniques

Récupérez 100 % du contenu textuel de tout PDF — natif vectoriel, scan papier numérisé, photo de document — en .txt brut UTF-8 ou .docx mis en forme (titres, paragraphes, listes, tableaux préservés). Notre moteur OCR repose sur Tesseract 5 LSTM (open source, licence Apache 2.0, entretenu par Google et la communauté depuis 2006), entraîné sur plus de 80 langues dont français, anglais, espagnol, allemand, italien, portugais, arabe, hébreu, chinois simplifié/traditionnel, japonais, coréen, russe, grec — différenciateur unique vs iLovePDF (limité à environ 25 langues OCR), Smallpdf (≈30 langues), pdfforge (SERP #1 sans batch ni multi-langues annoncées), PDF2Go, PDFCandy, OnlineOCR (free 15 pages/h max). Précision moyenne 97 % sur scans 300 dpi et 92 % sur photos smartphone corrigées par notre déskew/binarisation maison. Export conforme ISO 19005 PDF/A-1, PDF/A-2 et PDF/A-3 pour archivage légal et ISO 32000-2:2020 (PDF 2.0) avec encodage Unicode UTF-8 complet (idéal accents, ligatures, idéogrammes). Le texte extrait fait foi en justice au titre de l'article 1366 du Code civil (force probante de l'écrit électronique) et permet de respecter l'article L. 123-22 du Code de commerce (conservation des documents commerciaux pendant 10 ans) ainsi que la recommandation CNIL sur l'OCR de documents d'identité. Hébergement strictement européen Hetzner Frankfurt eu-central-1 (anti-arrêt CJUE Schrems II du 16 juillet 2020, C-311/18), chiffrement AES-256 au repos + TLS 1.3 en transit, conforme RGPD art. 32 et référentiel cryptographique ANSSI — zéro envoi à OpenAI, Anthropic, Google Vision, AWS Textract, Azure AI Document Intelligence. Vos PDF ne servent jamais à entraîner de modèle et sont supprimés automatiquement après 24 heures.

Allez plus loin avec l’accès à vie

Signature eIDAS, modèles métier, sans filigrane. 7,99 € en un seul paiement, à vie — aucun abonnement.

Voir l’offre

Questions fréquentes

Quelle est la différence avec l'OCR d'iLovePDF, Smallpdf ou Adobe Acrobat ?+

iFillPDF utilise **Tesseract 5 LSTM open source** (Apache 2.0) avec **plus de 80 langues** dont arabe, hébreu, chinois, japonais, coréen, russe — vs ≈25 langues sur **iLovePDF Premium (5,33 €/mois)**, ≈30 langues sur **Smallpdf Pro (9 €/mois)**, **Adobe Acrobat Pro (19,99 €/mois)** complet mais lourd, **ABBYY FineReader (199 €/an)** très précis mais payant strict, **Nanonets** pay-per-page enterprise, **OnlineOCR** free limité à **15 pages/h sans inscription**. iFillPDF reste **gratuit à vie (filigrane, 0 AI Deep Detect)** sans CB et héberge en UE Frankfurt — les autres routent souvent vers AWS US (Schrems II).

L'OCR fonctionne-t-il sur des scans manuscrits ou des photos prises au smartphone ?+

Sur **imprimés et dactylographiés** : précision moyenne **97 % à 300 dpi** et **92 % sur photos smartphone** corrigées par notre déskew/binarisation (algorithmes Otsu + Sauvola). Sur **manuscrits** : Tesseract 5 LSTM gère correctement l'**écriture cursive lisible** (≈70-85 % selon la calligraphie) ; pour des manuscrits anciens ou très calligraphiés, nous recommandons **Transkribus** (HTR spécialisé) ou **ABBYY FineReader 16**. Pour photos floues, activez l'option **« déflouer + accentuer contraste »** avant OCR.

Le texte extrait fait-il foi devant un tribunal ou un commissaire aux comptes ?+

Oui, sous conditions. L'**article 1366 du Code civil** reconnaît à l'écrit électronique la **même force probante que l'écrit papier** dès lors que la personne dont il émane peut être identifiée et que l'intégrité est garantie. Notre export **PDF/A-2u** (ISO 19005-2) couplant image originale et texte OCR caché, horodaté et chiffré AES-256, satisfait ces critères. Pour la conservation **10 ans imposée par l'article L. 123-22 du Code de commerce** (factures, contrats, livres comptables), le format PDF/A-3 incluant pièces jointes XML/CSV est recommandé. Pour une pièce probante forte en justice, il faut une **signature avancée (art. 26) ou qualifiée du Règlement UE 910/2014**, délivrée par un prestataire de services de confiance : iFillPDF n'en émet pas, notre outil signer-pdf produit une signature de niveau « simple » (art. 25).

Les documents traités sont-ils transmis à OpenAI, Google Vision, AWS Textract ou Azure ?+

**Non, jamais.** L'OCR tourne **localement sur nos serveurs Hetzner Frankfurt eu-central-1** (UE) avec **Tesseract 5 open source** — **zéro appel à OpenAI, Anthropic, Google Cloud Vision API, AWS Textract, Azure AI Document Intelligence**, contrairement à la plupart des SaaS américains qui exposent vos PDF à un sous-traitant US (problème **arrêt CJUE Schrems II du 16 juillet 2020, C-311/18**). Chiffrement **AES-256 au repos** + **TLS 1.3 en transit**, conforme **RGPD art. 32** (sécurité du traitement) et **référentiel cryptographique ANSSI**, suppression automatique des fichiers après **24 heures** (art. 5.1.e RGPD — limitation de conservation).

Peut-on extraire le texte d'un PDF protégé par mot de passe ou tatoué d'un copyright ?+

**Si vous détenez le mot de passe** : oui, saisissez-le et l'extraction se fait normalement. **Sans le mot de passe** : iFillPDF refuse par principe — contourner un mécanisme de protection sans autorisation expose à des sanctions au titre de l'**article L. 335-3-1 du Code de la propriété intellectuelle** (jusqu'à **3 ans de prison et 300 000 € d'amende**). Pour un PDF dont vous êtes l'auteur ou disposez d'une licence, utilisez d'abord notre outil **deverrouiller-pdf** puis extrayez le texte. Les **filigranes visuels** (image overlay) sont conservés dans l'export PDF/A mais le texte OCR sous-jacent reste lisible et indexable.

Quelle est la limite de taille, de pages, et le tarif au-delà ?+

Compte **gratuit** : **0 AI Deep Detect à vie**, **un document à la fois** (pas de traitement par lots), taille max **25 Mo/PDF**, **sans CB, avec filigrane** — vs **iLovePDF free** (15 Mo, 1 PDF), **PDFCandy free** (filigrane), **OnlineOCR free** (15 pages/h, sans inscription). Pack **Lifetime à 7,99 € payés une seule fois** : accès à vie **sans filigrane** sur les exports — vs **Smallpdf Pro (9 €/mois)** et **Adobe Acrobat Pro (19,99 €/mois)**. Les **AI Deep Detect** s'achètent en packs de crédits à l'unité (10 € les 10, 35 € les 50, 80 € les 200). Pour besoins enterprise (>100 000 pages/mois), tarif dégressif sur devis vs **Nanonets** pay-per-page (≈0,03 $/page) ou **ABBYY FineReader Engine (199 €/an + licence serveur)**.

Autres outils PDF

Continuez avec un outil connexe — essai sans inscription, compte gratuit pour télécharger.

Extraire texte PDF (OCR scan 80 langues) gratuit · iFillPDF