Udtræk Tekst fra Enhver PDF eller Ethvert Billede
OCR på 30+ sprog. Eksportér som søgbar PDF, Word DOCX, TXT eller Markdown. Kører helt i din browser — intet uploades til en server.
Træk og slip eller klik for at uploade
Scannet PDF, JPG, PNG, WebP eller TIFF
Maks. 100 sider pr. PDF · Flere billeder understøttes
Initialiserer…
Din fil er klar
Understøttede sprog
Eksportformater
- Søgbar PDF (anbefalet) — Originalt layout bevaret; teksten kan markeres i enhver PDF-læser
- Word-dokument (.docx) — Åbn og rediger i Microsoft Word eller Google Docs
- Ren tekst (.txt) — Ren tekstoutput, UTF-8-kodet
- Markdown (.md) — Struktureret tekst grupperet i afsnit
100 % Privat
Al OCR-behandling kører i din browser ved hjælp af WebAssembly. Dine filer sendes aldrig til nogen server — end ikke vores egen. Behandlingen er lige så privat som at læse et dokument på din egen skærm.
Hvorfor PDFlexa AI OCR?
Tesseract LSTM-Motor
Drevet af Tesseracts LSTM-neurale netværk — industristandarden for open source-OCR, med 95–99 % ordnøjagtighed på rene dokumenter.
Layout Bevaret
Den søgbare PDF-eksport holder det oprindelige sidebillede intakt og tilføjer et usynligt tekstlag — og bevarer dermed hver margen, kolonne og visuelt element.
Baggrundsbehandling
En dedikeret Web Worker kører OCR i en baggrundstråd — din browserfane forbliver fuldt interaktiv, mens store, flersidede dokumenter behandles.
33 Sprog
Fra arabisk og kinesisk til ukrainsk og thai — dækker praktisk talt alle større verdenssprog, herunder skriftsystemer fra højre mod venstre.
4 Eksportformater
Søgbar PDF, Word DOCX, ren TXT og Markdown — eksportér direkte til det format, der passer til din arbejdsgang, uden konverteringstrin.
Ingen Datalagring
Fordi behandlingen aldrig forlader din browser, er der ingen filer at opbevare eller slette. Dine dokumenter er lige så private som en fil på dit eget skrivebord.
Sådan udtrækker du tekst fra en scannet PDF
Upload din scannede PDF eller dit billede
Træk og slip en scannet PDF, JPG, PNG, WebP eller TIFF i uploadområdet, eller klik på "Vælg fil" for at gennemse. Flersidede PDF-filer og flere billedfiler understøttes.
Vælg sprog og outputformat
Vælg det sprog, dokumentet er skrevet på, blandt 33 tilgængelige muligheder. Vælg derefter dit foretrukne eksportformat — søgbar PDF anbefales for maksimal kompatibilitet.
Klik på "Start OCR" og download
OCR-motoren behandler dit dokument i en baggrunds-worker. En fremskridtslinje viser den side, der aktuelt behandles. Når det er færdigt, downloader du dit resultat øjeblikkeligt.
Ofte stillede spørgsmål om OCR
Hvad er OCR, og hvordan fungerer det?
OCR (optisk tegngenkendelse) omdanner billeder af tekst — scannede dokumenter, fotos af trykte sider eller PDF-filer med kun billeder — til maskinlæsbare tegn. Motoren analyserer pixelmønstre og matcher dem med bogstaver, tal og tegnsætning. Pdflexa bruger Tesseract, verdens mest præcise open source-OCR-motor, som kører helt i din browser.
Hvilke filformater accepterer OCR-værktøjet?
Du kan uploade scannede PDF-filer samt JPEG/JPG-, PNG-, WebP- og TIFF-billeder. Flersidede PDF-filer behandles side for side (op til 100 sider pr. fil). Batch-upload giver dig mulighed for at OCR-behandle flere billeder på én gang.
Hvor mange sprog understøtter OCR-motoren?
OCR-motoren understøtter 33 sprog, herunder dansk, engelsk, spansk, fransk, tysk, kinesisk (forenklet og traditionelt), japansk, koreansk, arabisk, russisk, hindi og flere. Vælg det korrekte dokumentsprog før behandling for at maksimere nøjagtigheden.
Bliver mit dokument uploadet til Pdflexas servere?
Nej. Hvert trin — PDF-gengivelse, OCR-genkendelse og output-generering — kører helt inde i din browser ved hjælp af WebAssembly og JavaScript. Dine filer forlader aldrig din enhed, hvilket gør dette til det mest private OCR-værktøj, der er tilgængeligt online.
Hvilke outputformater kan jeg eksportere?
Du kan eksportere den genkendte tekst som søgbar PDF (originalbillede med et usynligt tekstlag, der gør det markerbart og kopierbart i enhver PDF-læser), ren TXT, Microsoft Word DOCX eller Markdown. Alle formater bevarer tekstens logiske læserækkefølge.
Hvor præcis er tekstgenkendelsen?
Nøjagtigheden afhænger af dokumentets kvalitet, opløsning og sprog. Rene scanninger i høj opløsning (300 DPI eller derover) på et understøttet sprog opnår typisk over 98 % ordnøjagtighed med Tesseracts LSTM-motor. Håndskrift, dekorative skrifttyper, dokumenter med lav kontrast eller sider med blandede sprog vil have lavere nøjagtighed.
Kan jeg OCR-behandle en stor PDF med mange sider?
Ja. OCR-motoren behandler sider sekventielt ved hjælp af en baggrunds-Web Worker, så din browsers brugergrænseflade forbliver responsiv hele tiden. Op til 100 sider pr. fil understøttes. For meget store dokumenter kan behandlingen tage nogle minutter — en fremskridtsindikator i realtid viser, hvilken side der aktuelt behandles.
Bevarer OCR det originale dokumentlayout?
Den søgbare PDF-eksport bevarer det originale visuelle layout perfekt, fordi sidebilledet holdes intakt, og teksten skrives som et usynligt overlag. Ved TXT-, DOCX- og Markdown-eksport udtrækkes teksten i læserækkefølge, men den visuelle formatering (kolonner, tabeller) tilnærmes snarere end gengives præcist.