Yapay Zeka Destekli

Herhangi Bir PDF'den veya Görselden Metin Çıkarın

30'dan fazla dilde OCR. Aranabilir PDF, Word DOCX, TXT veya Markdown olarak dışa aktarın. Tamamen tarayıcınızda çalışır — sunucuya hiçbir şey yüklenmez.

Sürükleyip bırakın veya yüklemek için tıklayın

Taranmış PDF, JPG, PNG, WebP veya TIFF

PDF başına maks. 100 sayfa · Birden çok görsel desteklenir

Desteklenen Diller

Arapça Bulgarca Çince (Basitleştirilmiş) Çince (Geleneksel) Hırvatça Çekçe Danca Felemenkçe İngilizce Fince Fransızca Almanca Yunanca İbranice Hintçe Macarca Endonezce İtalyanca Japonca Korece Norveççe Lehçe Portekizce Rumence Rusça Sırpça Slovakça Slovence İspanyolca İsveççe Tayca Türkçe Ukraynaca

Dışa Aktarma Biçimleri

  • Aranabilir PDF (önerilir) — Orijinal düzen korunur; metin herhangi bir PDF görüntüleyicide seçilebilir
  • Word Belgesi (.docx) — Microsoft Word veya Google Docs'ta açın ve düzenleyin
  • Düz Metin (.txt) — Temiz metin çıktısı, UTF-8 kodlamalı
  • Markdown (.md) — Paragraflara göre gruplanmış yapılandırılmış metin

%100 Gizli

Tüm OCR işleme, WebAssembly kullanılarak tarayıcınızda gerçekleşir. Dosyalarınız hiçbir sunucuya — hatta bizimkine bile — asla gönderilmez. İşleme, bir belgeyi kendi ekranınızda okumak kadar gizlidir.

Neden PDFlexa AI OCR?

Tesseract LSTM Motoru

Tesseract'ın LSTM sinir ağı destekli — açık kaynaklı OCR için endüstri standardı, temiz belgelerde %95–99 kelime doğruluğuyla.

Düzen Korunur

Aranabilir PDF dışa aktarımı, orijinal sayfa görüntüsünü olduğu gibi korur ve görünmez bir metin katmanı ekler — her kenar boşluğunu, sütunu ve görsel öğeyi koruyarak.

Arka Plan İşleme

Özel bir Web Worker, OCR'ı bir arka plan iş parçacığında çalıştırır — büyük, çok sayfalı belgeler işlenirken tarayıcı sekmeniz tamamen etkileşimli kalır.

33 Dil

Arapça ve Çince'den Ukraynaca ve Tayca'ya — sağdan sola yazılanlar dahil olmak üzere dünyanın hemen hemen her büyük dilini kapsar.

4 Dışa Aktarma Formatı

Aranabilir PDF, Word DOCX, düz TXT ve Markdown — dönüştürme adımına gerek kalmadan doğrudan iş akışınıza uygun formata dışa aktarın.

Sıfır Veri Saklama

İşleme asla tarayıcınızdan ayrılmadığı için saklanacak veya silinecek dosya yoktur. Belgeleriniz kendi masanızdaki bir dosya kadar gizlidir.

Taranmış Bir PDF'den Metin Nasıl Çıkarılır

Taranmış PDF'inizi veya Görselinizi Yükleyin

Taranmış bir PDF, JPG, PNG, WebP veya TIFF'i yükleme alanına sürükleyip bırakın veya göz atmak için "Dosya seç"e tıklayın. Çok sayfalı PDF'ler ve birden fazla görsel dosyası desteklenir.

Dil ve Çıktı Formatını Seçin

Belgenin yazıldığı dili 33 mevcut seçenek arasından seçin. Ardından tercih ettiğiniz dışa aktarma formatını seçin — maksimum uyumluluk için aranabilir PDF önerilir.

"OCR'ı Başlat"a Tıklayın ve İndirin

OCR motoru belgenizi bir arka plan işçisinde işler. Bir ilerleme çubuğu şu anda hangi sayfanın işlendiğini gösterir. Tamamlandığında sonucunuzu anında indirin.

OCR Hakkında Sıkça Sorulan Sorular

OCR nedir ve nasıl çalışır?

OCR (Optik Karakter Tanıma), metin görüntülerini — taranmış belgeler, basılı sayfaların fotoğrafları veya yalnızca görsel içeren PDF'ler — makine tarafından okunabilir karakterlere dönüştürür. Motor, piksel desenlerini analiz eder ve bunları harflere, sayılara ve noktalama işaretlerine eşler. Pdflexa, dünyanın en doğru açık kaynaklı OCR motoru olan ve tamamen tarayıcınızda çalışan Tesseract'ı kullanır.

OCR aracı hangi dosya formatlarını kabul eder?

Taranmış PDF dosyalarının yanı sıra JPEG/JPG, PNG, WebP ve TIFF görsellerini yükleyebilirsiniz. Çok sayfalı PDF'ler sayfa sayfa işlenir (dosya başına 100 sayfaya kadar). Toplu yükleme, birden fazla görseli aynı anda OCR'dan geçirmenize olanak tanır.

OCR motoru kaç dili destekler?

OCR motoru; Türkçe, İngilizce, İspanyolca, Fransızca, Almanca, Çince (Basitleştirilmiş ve Geleneksel), Japonca, Korece, Arapça, Rusça, Hintçe ve daha fazlası dahil olmak üzere 33 dili destekler. Doğruluğu en üst düzeye çıkarmak için işlemeden önce doğru belge dilini seçin.

Belgem Pdflexa sunucularına yükleniyor mu?

Hayır. Her adım — PDF görüntüleme, OCR tanıma ve çıktı oluşturma — WebAssembly ve JavaScript kullanılarak tamamen tarayıcınızın içinde çalışır. Dosyalarınız cihazınızdan asla ayrılmaz, bu da bunu çevrimiçi olarak mevcut en gizli OCR aracı yapar.

Hangi çıktı formatlarını dışa aktarabilirim?

Tanınan metni aranabilir PDF (herhangi bir PDF görüntüleyicisinde seçilebilir ve kopyalanabilir hale getiren görünmez bir metin katmanına sahip orijinal görüntü), düz TXT, Microsoft Word DOCX veya Markdown olarak dışa aktarabilirsiniz. Tüm formatlar metnin mantıksal okuma sırasını korur.

Metin tanıma ne kadar doğru?

Doğruluk, belge kalitesine, çözünürlüğe ve dile bağlıdır. Desteklenen bir dilde 300 DPI veya üzeri temiz, yüksek çözünürlüklü taramalar, Tesseract'ın LSTM motoruyla genellikle %98'in üzerinde kelime doğruluğu elde eder. El yazısı, süslü yazı tipleri, düşük kontrastlı belgeler veya karışık dilli sayfalar daha düşük doğruluğa sahip olacaktır.

Çok sayfalı büyük bir PDF'yi OCR'dan geçirebilir miyim?

Evet. OCR motoru, sayfaları arka planda çalışan bir Web Worker kullanarak sırayla işler, böylece tarayıcı arayüzünüz her zaman duyarlı kalır. Dosya başına 100 sayfaya kadar desteklenir. Çok büyük belgeler için işleme birkaç dakika sürebilir — gerçek zamanlı bir ilerleme göstergesi hangi sayfanın işlendiğini gösterir.

OCR, orijinal belge düzenini korur mu?

Aranabilir PDF dışa aktarımı, sayfa görüntüsü olduğu gibi korunduğu ve metin görünmez bir katman olarak yazıldığı için orijinal görsel düzeni mükemmel şekilde korur. TXT, DOCX ve Markdown dışa aktarımlarında metin okuma sırasına göre çıkarılır, ancak görsel biçimlendirme (sütunlar, tablolar) tam olarak değil, yaklaşık olarak yeniden oluşturulur.

İlgili Araçlar