PDF 转文字
概述
PDF 转文字 使用 AI OCR 从任何 PDF 中提取可编辑的文字内容。与「PDF 翻译」不同——后者在保留版式的前提下翻译文档——「PDF 转文字」专注于从扫描件和图片型 PDF 中提取文字,尤其适合无法直接选中文字的文档。
支持的 PDF 类型
- 电子 PDF — 有原生文字层,提取快速且准确
- 扫描件 / 图片型 PDF — 页面本身是图片,AI OCR 从视觉中识别文字
- 混合内容 — 同时包含文字层和嵌入图片的文档
文件上限:50 MB。
如何从 PDF 提取文字
- 打开 PDF 转文字 页面。
- 上传 PDF 文件——拖放或点击选择。
- 如需在提取后翻译,选择目标语言(可选)。
- 点击 PDF 转文字——AI OCR 流水线启动。
- 等待处理——OCR 工作台自动打开,实时显示进度。
- 在工作台编辑器中校对提取的文字。
- 导出为所需格式。
输出格式
| 格式 | 适用场景 |
|---|---|
| TXT | 纯文本,复制粘贴,简单编辑 |
| DOCX | Microsoft Word 文档,带格式排版 |
| HTML | 网页发布,富文本 |
| Markdown | 技术文档,笔记应用,代码友好 |
语言支持
AI OCR 自动检测文档语言。支持语言:中文、英文、西班牙语、法语、德语、日语、韩语、俄语、希腊语、意大利语等 10+ 种。提取完成后,内置翻译引擎可在工作台中直接将文字翻译为任意支持语言。
定价与积分
新用户注册即获免费试用积分,可用于 PDF 转文字体验。每页消耗积分按当前定价配置计算。高级选项包括大文件高分辨率处理和优先处理速度。
查看 定价页 了解当前积分包和订阅方案。
最佳效果提示
- 使用清晰的高分辨率扫描件——150 DPI 以上效果最佳
- 确保原文档中的文字清晰可读、光线充足
- 混合语言文档由 AI 自动检测主语言
- 如需最大保真度,优先导出为 HTML 格式