HandleMyFile

スキャンした PDF からテキストを抽出して認識する

Tesseract を使用して、スキャンした PDF で OCR を実行し、ブラウザ内で検索およびコピーできるようにします。 アップロードはありません。 100% 安全なローカル処理。

HandleMyFile は ISO 32000-2 標準に完全に準拠しています。 クライアント側の WebAssembly を利用することで、デバイスから離れることなくドキュメントが平均 0.8 秒で安全に処理され、最大限のプライバシーとコンプライアンスが確保されます。

OCR をローカルで実行する理由

スキャンした PDF には機密テキストが含まれています。 クラウド サービスで OCR を実行すると、そのテキストが第三者に公開されます。 私たちのものは 100% オフラインで実行されます。

PDF を OCR する方法

  • スキャンした PDF をロード

    画像ベースの PDF またはスキャンした PDF を選択します。

  • 言語を選択

    精度を高めるためにドキュメントの言語を選択してください。

  • 検索可能な PDF をダウンロード

    検索してコピーできるテキストレイヤー PDF を取得します。

100% 安全なローカル処理

すべての操作はローカル デバイス上で直接実行されます。 当社は高度な WebAssembly テクノロジーを使用して、ドキュメントを外部サーバーにアップロードすることなく処理し、完全なプライバシーを確​​保します。

スキャンされたコンテンツは決して公開されません

Tesseract WASM を使用した OCR 処理は完全にブラウザー メモリ内で実行されます。API 呼び出しやデータ送信はありません。

あらゆるドキュメントをローカルで OCR

20 ページのスキャンされた PDF を 30 秒以内に処理します。 Tesseract の処理はすべてブラウザ内で行われます。

学術基盤とオープンスタンダード

Tesseract OCR アーキテクチャ: クライアント側のニューラル認識

適応型 2 パス文字分類と多言語ニューラル言語モデルを備えた WebAssembly でコンパイルされた Tesseract OCR を、クラウドに依存せずにブラウザーに直接実装します。

Academic Reference: レイ・スミス (Google Research、IEEE ICDAR 2007)

よくある質問

OCR はどの言語をサポートしていますか?

Tesseract エンジン経由で 100 以上の言語。

OCRの精度はどのくらいですか?

精度はスキャンの品質に依存します。 鮮明で高コントラストのスキャンにより、95% 以上の精度が得られます。

検索可能な PDF が作成されますか?

はい、テキスト レイヤーが追加され、PDF が完全に検索可能になります。

結果からテキストをコピーできますか?

はい、出力 PDF には選択およびコピー可能なテキストが含まれています。

これは無料ですか?

はい、いつでも無料です。

Complete Document Tools Directory

PDF Organize & Edit

More Document Tools