AI-drevet

Udtræk Tekst fra Enhver PDF eller Ethvert Billede

OCR på 30+ sprog. Eksportér som søgbar PDF, Word DOCX, TXT eller Markdown. Kører helt i din browser — intet uploades til en server.

Træk og slip eller klik for at uploade

Scannet PDF, JPG, PNG, WebP eller TIFF

Maks. 100 sider pr. PDF · Flere billeder understøttes

Understøttede sprog

Arabisk Bulgarsk Kinesisk (forenklet) Kinesisk (traditionelt) Kroatisk Tjekkisk Dansk Hollandsk Engelsk Finsk Fransk Tysk Græsk Hebraisk Hindi Ungarsk Indonesisk Italiensk Japansk Koreansk Norsk Polsk Portugisisk Rumænsk Russisk Serbisk Slovakisk Slovensk Spansk Svensk Thai Tyrkisk Ukrainsk

Eksportformater

  • Søgbar PDF (anbefalet) — Originalt layout bevaret; teksten kan markeres i enhver PDF-læser
  • Word-dokument (.docx) — Åbn og rediger i Microsoft Word eller Google Docs
  • Ren tekst (.txt) — Ren tekstoutput, UTF-8-kodet
  • Markdown (.md) — Struktureret tekst grupperet i afsnit

100 % Privat

Al OCR-behandling kører i din browser ved hjælp af WebAssembly. Dine filer sendes aldrig til nogen server — end ikke vores egen. Behandlingen er lige så privat som at læse et dokument på din egen skærm.

Hvorfor PDFlexa AI OCR?

Tesseract LSTM-Motor

Drevet af Tesseracts LSTM-neurale netværk — industristandarden for open source-OCR, med 95–99 % ordnøjagtighed på rene dokumenter.

Layout Bevaret

Den søgbare PDF-eksport holder det oprindelige sidebillede intakt og tilføjer et usynligt tekstlag — og bevarer dermed hver margen, kolonne og visuelt element.

Baggrundsbehandling

En dedikeret Web Worker kører OCR i en baggrundstråd — din browserfane forbliver fuldt interaktiv, mens store, flersidede dokumenter behandles.

33 Sprog

Fra arabisk og kinesisk til ukrainsk og thai — dækker praktisk talt alle større verdenssprog, herunder skriftsystemer fra højre mod venstre.

4 Eksportformater

Søgbar PDF, Word DOCX, ren TXT og Markdown — eksportér direkte til det format, der passer til din arbejdsgang, uden konverteringstrin.

Ingen Datalagring

Fordi behandlingen aldrig forlader din browser, er der ingen filer at opbevare eller slette. Dine dokumenter er lige så private som en fil på dit eget skrivebord.

Sådan udtrækker du tekst fra en scannet PDF

Upload din scannede PDF eller dit billede

Træk og slip en scannet PDF, JPG, PNG, WebP eller TIFF i uploadområdet, eller klik på "Vælg fil" for at gennemse. Flersidede PDF-filer og flere billedfiler understøttes.

Vælg sprog og outputformat

Vælg det sprog, dokumentet er skrevet på, blandt 33 tilgængelige muligheder. Vælg derefter dit foretrukne eksportformat — søgbar PDF anbefales for maksimal kompatibilitet.

Klik på "Start OCR" og download

OCR-motoren behandler dit dokument i en baggrunds-worker. En fremskridtslinje viser den side, der aktuelt behandles. Når det er færdigt, downloader du dit resultat øjeblikkeligt.

Ofte stillede spørgsmål om OCR

Hvad er OCR, og hvordan fungerer det?

OCR (optisk tegngenkendelse) omdanner billeder af tekst — scannede dokumenter, fotos af trykte sider eller PDF-filer med kun billeder — til maskinlæsbare tegn. Motoren analyserer pixelmønstre og matcher dem med bogstaver, tal og tegnsætning. Pdflexa bruger Tesseract, verdens mest præcise open source-OCR-motor, som kører helt i din browser.

Hvilke filformater accepterer OCR-værktøjet?

Du kan uploade scannede PDF-filer samt JPEG/JPG-, PNG-, WebP- og TIFF-billeder. Flersidede PDF-filer behandles side for side (op til 100 sider pr. fil). Batch-upload giver dig mulighed for at OCR-behandle flere billeder på én gang.

Hvor mange sprog understøtter OCR-motoren?

OCR-motoren understøtter 33 sprog, herunder dansk, engelsk, spansk, fransk, tysk, kinesisk (forenklet og traditionelt), japansk, koreansk, arabisk, russisk, hindi og flere. Vælg det korrekte dokumentsprog før behandling for at maksimere nøjagtigheden.

Bliver mit dokument uploadet til Pdflexas servere?

Nej. Hvert trin — PDF-gengivelse, OCR-genkendelse og output-generering — kører helt inde i din browser ved hjælp af WebAssembly og JavaScript. Dine filer forlader aldrig din enhed, hvilket gør dette til det mest private OCR-værktøj, der er tilgængeligt online.

Hvilke outputformater kan jeg eksportere?

Du kan eksportere den genkendte tekst som søgbar PDF (originalbillede med et usynligt tekstlag, der gør det markerbart og kopierbart i enhver PDF-læser), ren TXT, Microsoft Word DOCX eller Markdown. Alle formater bevarer tekstens logiske læserækkefølge.

Hvor præcis er tekstgenkendelsen?

Nøjagtigheden afhænger af dokumentets kvalitet, opløsning og sprog. Rene scanninger i høj opløsning (300 DPI eller derover) på et understøttet sprog opnår typisk over 98 % ordnøjagtighed med Tesseracts LSTM-motor. Håndskrift, dekorative skrifttyper, dokumenter med lav kontrast eller sider med blandede sprog vil have lavere nøjagtighed.

Kan jeg OCR-behandle en stor PDF med mange sider?

Ja. OCR-motoren behandler sider sekventielt ved hjælp af en baggrunds-Web Worker, så din browsers brugergrænseflade forbliver responsiv hele tiden. Op til 100 sider pr. fil understøttes. For meget store dokumenter kan behandlingen tage nogle minutter — en fremskridtsindikator i realtid viser, hvilken side der aktuelt behandles.

Bevarer OCR det originale dokumentlayout?

Den søgbare PDF-eksport bevarer det originale visuelle layout perfekt, fordi sidebilledet holdes intakt, og teksten skrives som et usynligt overlag. Ved TXT-, DOCX- og Markdown-eksport udtrækkes teksten i læserækkefølge, men den visuelle formatering (kolonner, tabeller) tilnærmes snarere end gengives præcist.

Relaterede værktøjer