AI搭載

あらゆるPDFや画像からテキストを抽出

30以上の言語でOCR。検索可能なPDF、Word DOCX、TXT、Markdownとしてエクスポート。すべてブラウザ内で完結 — サーバーには何もアップロードされません。

ドラッグ&ドロップまたはクリックしてアップロード

スキャンしたPDF、JPG、PNG、WebP、TIFF

PDFあたり最大100ページ・複数画像対応

対応言語

アラビア語 ブルガリア語 中国語(簡体字) 中国語(繁体字) クロアチア語 チェコ語 デンマーク語 オランダ語 英語 フィンランド語 フランス語 ドイツ語 ギリシャ語 ヘブライ語 ヒンディー語 ハンガリー語 インドネシア語 イタリア語 日本語 韓国語 ノルウェー語 ポーランド語 ポルトガル語 ルーマニア語 ロシア語 セルビア語 スロバキア語 スロベニア語 スペイン語 スウェーデン語 タイ語 トルコ語 ウクライナ語

書き出し形式

  • 検索可能なPDF(推奨) — 元のレイアウトを保持;あらゆるPDFビューアでテキストを選択可能
  • Word文書(.docx) — Microsoft WordまたはGoogleドキュメントで開いて編集
  • プレーンテキスト(.txt) — クリーンなテキスト出力、UTF-8エンコード
  • Markdown(.md) — 段落ごとにグループ化された構造化テキスト

100%プライベート

すべてのOCR処理はWebAssemblyを使ってブラウザ内で実行されます。ファイルはいかなるサーバーにも送信されません — 当社のサーバーにも送信されません。処理は自分の画面でドキュメントを読むのと同じくらいプライベートです。

PDFlexa AI OCRを使う理由

Tesseract LSTMエンジン

TesseractのLSTMニューラルネットワーク搭載 — オープンソースOCRの業界標準で、クリーンな文書では95〜99%の単語精度を実現。

レイアウト保持

検索可能なPDFエクスポートは元のページ画像をそのまま保持し、見えないテキストレイヤーを追加します — すべての余白、列、視覚要素を保持します。

バックグラウンド処理

専用のWeb WorkerがバックグラウンドスレッドでOCRを実行 — 大規模で複数ページの文書を処理している間もブラウザタブは完全にインタラクティブなままです。

33言語

アラビア語や中国語からウクライナ語、タイ語まで — 右から左に書く文字体系を含む、世界の主要言語をほぼすべてカバーしています。

4つのエクスポート形式

検索可能なPDF、Word DOCX、プレーンTXT、Markdown — 変換ステップなしで、ワークフローに合った形式に直接エクスポートできます。

データ保持ゼロ

処理がブラウザから外に出ることは決してないため、保持または削除すべきファイルはありません。あなたの文書は自分のデスク上のファイルと同じくらいプライベートです。

スキャンしたPDFからテキストを抽出する方法

スキャンしたPDFまたは画像をアップロード

スキャンしたPDF、JPG、PNG、WebP、またはTIFFをアップロードエリアにドラッグ&ドロップするか、「ファイルを選択」をクリックして参照します。複数ページのPDFや複数の画像ファイルに対応しています。

言語と出力形式を選択

33の利用可能なオプションから文書が書かれている言語を選択します。次に希望のエクスポート形式を選択します — 最大限の互換性のために検索可能なPDFをお勧めします。

「OCR開始」をクリックしてダウンロード

OCRエンジンはバックグラウンドワーカーで文書を処理します。進行状況バーが現在処理中のページを表示します。完了したら、結果をすぐにダウンロードできます。

OCRに関するよくある質問

OCRとは何ですか?どのように機能しますか?

OCR(光学文字認識)は、スキャンされた文書、印刷ページの写真、画像のみのPDFなど、テキストの画像を機械可読な文字に変換します。エンジンはピクセルパターンを分析し、文字、数字、句読点にマッピングします。Pdflexaは世界で最も正確なオープンソースOCRエンジンであるTesseractを使用しており、すべてブラウザ内で動作します。

OCRツールはどのファイル形式に対応していますか?

スキャンされたPDFファイルおよびJPEG/JPG、PNG、WebP、TIFF画像をアップロードできます。複数ページのPDFはページごとに処理されます(ファイルあたり最大100ページ)。バッチアップロードにより、複数の画像を一度にOCR処理できます。

OCRエンジンは何言語対応していますか?

OCRエンジンは日本語、英語、スペイン語、フランス語、ドイツ語、中国語(簡体字・繁体字)、韓国語、アラビア語、ロシア語、ヒンディー語など33言語に対応しています。精度を最大化するため、処理前に正しい文書言語を選択してください。

私の文書はPdflexaのサーバーにアップロードされますか?

いいえ。PDFレンダリング、OCR認識、出力生成というすべてのステップがWebAssemblyとJavaScriptを使ってブラウザ内で完全に実行されます。ファイルがデバイスから外に出ることは決してなく、オンラインで利用可能な最もプライベートなOCRツールとなっています。

どの出力形式にエクスポートできますか?

認識されたテキストは、検索可能なPDF(元の画像に見えないテキストレイヤーが付き、あらゆるPDFビューアで選択・コピー可能)、プレーンTXT、Microsoft Word DOCX、またはMarkdownとしてエクスポートできます。すべての形式でテキストの論理的な読み順が保持されます。

テキスト認識の精度はどのくらいですか?

精度は文書の品質、解像度、言語によって異なります。300DPI以上のクリーンで高解像度のスキャンで対応言語であれば、TesseractのLSTMエンジンで通常98%以上の単語精度を達成します。手書き文字、装飾フォント、コントラストの低い文書、複数言語が混在するページは精度が低くなります。

ページ数の多い大きなPDFをOCRできますか?

はい。OCRエンジンはバックグラウンドのWeb Workerを使ってページを順次処理するため、ブラウザのUIは常に応答性を保ちます。ファイルあたり最大100ページに対応しています。非常に大きな文書の場合、処理に数分かかることがあります — リアルタイムの進行状況インジケーターが現在処理中のページを表示します。

OCRは元の文書レイアウトを保持しますか?

検索可能なPDFエクスポートはページ画像がそのまま保持され、テキストが見えないオーバーレイとして書き込まれるため、元の視覚的レイアウトを完璧に保持します。TXT、DOCX、Markdownエクスポートでは、テキストは読み順で抽出されますが、視覚的な書式(列、表)は正確に再現されるのではなく近似されます。

関連ツール