PDF をテキストに変換
AI OCRでPDFから文字を抽出——スキャン文書、画像PDF、デジタルファイルに対応。TXT、DOCX、HTML、Markdownに出力。
概要
PDF をテキストに変換 は、AI OCRを使ってあらゆるPDFからテキストを抽出します。レイアウトを保持したまま翻訳するPDF Translateとは異なり、PDFをテキストに変換では、特にスキャン文書や画像ベースのPDFなど文字選択ができない文書から編集可能な文字を取り出すことに特化しています。
対応PDFタイプ
- デジタルPDF — ネイティブテキストレイヤー、高速かつ正確に抽出
- スキャン・画像PDF — ページ自体が画像。AI OCRが視覚的に文字を認識
- 混在コンテンツ — デジタルテキストと埋め込み画像の両方を含む文書
最大ファイルサイズ: 50MB。
PDFから文字を抽出する手順
- PDF をテキストに変換 ページを開く。
- PDFをアップロード——ドラッグ&ドロップ、またはクリックしてファイルを選択。
- 抽出後に翻訳する場合は目標言語を選択(任意)。
- PDF をテキストに変換 をクリック——AI OCRパイプラインが開始。
- 処理を待つ——OCRワークベンチが自動的に開き、リアルタイムで進捗を表示。
- 抽出された文字をワークベンチエディタで確認・編集。
- 任意のフォーマットでエクスポート。
出力フォーマット
| フォーマット | 最適な用途 |
|---|---|
| TXT | プレーンテキスト、コピペ、簡易編集 |
| DOCX | Microsoft Word、フォーマット付き文書 |
| HTML | Web公開、リッチテキスト |
| Markdown | 技術文書、ノートアプリ、コードとの親和性 |
言語サポート
AI OCRが文書の言語を自動検出します。対応言語: 英語、中国語、スペイン語、フランス語、ドイツ語、日本語、韓国語、ロシア語、ギリシャ語、イタリア語他。抽出後、内蔵翻訳エンジンでワークベンチから直接任意の対応言語に翻訳できます。
料金とクレジット
新規ユーザーには無料トライアルクレジットが付与され、PDFをテキストに変換を試用できます。ページごとに現在の料金設定に基づいてクレジットが消費されます。プレミアムオプションでは、高解像度処理と優先処理速度を提供します。
最新のクレジットパックとサブスクリプションプランは**料金ページ**でご確認ください。
最適な結果を得るためのヒント
- 鮮明で高解像度のスキャンを使用——150 DPI以上が最適
- 元文書の文字が判読可能で均一な明るさであることを確認
- 多言語文書の場合、AIが自動的に主要言語を検出
- 特定の機能が不足している場合は、HTMLでのエクスポートを試すと最大限の再現性が得られます