Haal Tekst uit Elke PDF of Afbeelding
OCR in 30+ talen. Exporteer als doorzoekbare PDF, Word DOCX, TXT of Markdown. Werkt volledig in je browser — er wordt niets naar een server geüpload.
Sleep of klik om te uploaden
Gescande PDF, JPG, PNG, WebP of TIFF
Max 100 pagina's per PDF · Meerdere afbeeldingen ondersteund
Initialiseren…
Uw bestand is gereed
Ondersteunde talen
Exportformaten
- Doorzoekbare PDF (aanbevolen) — Originele opmaak behouden; tekst is selecteerbaar in elke PDF-viewer
- Word-document (.docx) — Open en bewerk in Microsoft Word of Google Docs
- Platte tekst (.txt) — Schone tekstuitvoer, UTF-8-gecodeerd
- Markdown (.md) — Gestructureerde tekst gegroepeerd per alinea
100% Privé
Alle OCR-verwerking vindt plaats in je browser met WebAssembly. Je bestanden worden nooit naar een server verzonden — zelfs niet naar de onze. Verwerking is net zo privé als het lezen van een document op je eigen scherm.
Waarom PDFlexa AI OCR?
Tesseract LSTM-Engine
Aangedreven door het LSTM-neurale netwerk van Tesseract — de industriestandaard voor open-source OCR, met 95–99% woordnauwkeurigheid bij schone documenten.
Opmaak Behouden
De doorzoekbare PDF-export houdt de originele paginaafbeelding intact en voegt een onzichtbare tekstlaag toe — waardoor elke marge, kolom en visueel element behouden blijft.
Verwerking op de Achtergrond
Een speciale Web Worker voert OCR uit in een achtergrondthread — je browsertabblad blijft volledig interactief terwijl grote, meerpagina-documenten worden verwerkt.
33 Talen
Van Arabisch en Chinees tot Oekraïens en Thais — dekt vrijwel elke belangrijke wereldtaal, inclusief van-rechts-naar-links-schriften.
4 Exportformaten
Doorzoekbare PDF, Word DOCX, platte TXT en Markdown — exporteer direct naar het formaat dat bij je workflow past, zonder conversiestap.
Geen Gegevensbewaring
Omdat de verwerking je browser nooit verlaat, zijn er geen bestanden om te bewaren of verwijderen. Je documenten zijn net zo privé als een bestand op je eigen bureau.
Hoe u tekst uit een gescande PDF haalt
Upload je gescande PDF of afbeelding
Sleep een gescande PDF, JPG, PNG, WebP of TIFF naar het uploadgebied, of klik op "Bestand kiezen" om te bladeren. PDF's met meerdere pagina's en meerdere afbeeldingsbestanden worden ondersteund.
Selecteer taal en uitvoerformaat
Kies de taal waarin het document is geschreven uit 33 beschikbare opties. Kies vervolgens je gewenste exportformaat — doorzoekbare PDF wordt aanbevolen voor maximale compatibiliteit.
Klik op "Start OCR" en download
De OCR-engine verwerkt je document in een achtergrond-worker. Een voortgangsbalk toont de pagina die momenteel wordt verwerkt. Download je resultaat direct zodra het klaar is.
Veelgestelde vragen over OCR
Wat is OCR en hoe werkt het?
OCR (Optical Character Recognition) zet afbeeldingen van tekst — gescande documenten, foto's van gedrukte pagina's of alleen-afbeelding-PDF's — om in machineleesbare tekens. De engine analyseert pixelpatronen en koppelt deze aan letters, cijfers en leestekens. Pdflexa gebruikt Tesseract, 's werelds meest nauwkeurige opensource-OCR-engine, die volledig in je browser draait.
Welke bestandsformaten accepteert de OCR-tool?
Je kunt gescande PDF-bestanden en JPEG/JPG-, PNG-, WebP- en TIFF-afbeeldingen uploaden. PDF's met meerdere pagina's worden pagina voor pagina verwerkt (tot 100 pagina's per bestand). Met batch-upload kun je meerdere afbeeldingen tegelijk laten verwerken.
Hoeveel talen ondersteunt de OCR-engine?
De OCR-engine ondersteunt 33 talen, waaronder Nederlands, Engels, Spaans, Frans, Duits, Chinees (vereenvoudigd en traditioneel), Japans, Koreaans, Arabisch, Russisch, Hindi en meer. Selecteer de juiste documenttaal vóór verwerking om de nauwkeurigheid te maximaliseren.
Wordt mijn document geüpload naar de servers van Pdflexa?
Nee. Elke stap — PDF-weergave, OCR-herkenning en het genereren van de uitvoer — vindt volledig plaats in je browser met behulp van WebAssembly en JavaScript. Je bestanden verlaten nooit je apparaat, wat dit de meest privacyvriendelijke OCR-tool online maakt.
Welke uitvoerformaten kan ik exporteren?
Je kunt de herkende tekst exporteren als doorzoekbare PDF (originele afbeelding met een onzichtbare tekstlaag, waardoor deze selecteerbaar en kopieerbaar is in elke PDF-viewer), platte TXT, Microsoft Word DOCX, of Markdown. Alle formaten behouden de logische leesvolgorde van de tekst.
Hoe nauwkeurig is de tekstherkenning?
De nauwkeurigheid hangt af van documentkwaliteit, resolutie en taal. Schone, hoge-resolutiescans van 300 DPI of hoger in een ondersteunde taal behalen doorgaans meer dan 98% woordnauwkeurigheid met de LSTM-engine van Tesseract. Handschrift, decoratieve lettertypen, documenten met weinig contrast of pagina's met gemengde talen zullen een lagere nauwkeurigheid hebben.
Kan ik OCR toepassen op een grote PDF met veel pagina's?
Ja. De OCR-engine verwerkt pagina's opeenvolgend via een achtergrond-Web Worker, zodat de interface van je browser gedurende het hele proces reactief blijft. Er worden tot 100 pagina's per bestand ondersteund. Voor zeer grote documenten kan de verwerking enkele minuten duren — een real-time voortgangsindicator toont welke pagina wordt verwerkt.
Behoudt OCR de originele documentopmaak?
De doorzoekbare PDF-export behoudt de originele visuele opmaak perfect, omdat de paginaafbeelding intact blijft en de tekst als onzichtbare laag wordt toegevoegd. Bij TXT-, DOCX- en Markdown-exports wordt de tekst in leesvolgorde geëxtraheerd, maar de visuele opmaak (kolommen, tabellen) wordt benaderd in plaats van exact gereproduceerd.