免费在线将扫描件 PDF 中的文字识别为可搜索、可复制的文本。支持中英文混合识别,输出可搜索 PDF 或纯文本。
立即识别 PDF 文字点击上传或拖拽扫描件/图片 PDF 文件到页面。
选择文档语言(支持中文、英文、中英混合),启动 OCR 引擎进行识别。
选择输出格式:可搜索 PDF(文字层叠加)或纯文本/Markdown 文件。
支持中文、英文、中英混合、日文等多语种 OCR 识别,准确率达 97%+。
识别后在 PDF 中叠加透明文字层,生成可搜索、可选中的 PDF 文件。
支持将识别结果导出为 TXT 文本或 Markdown 格式,方便整理和引用。
基于 Tesseract.js 引擎在浏览器内运行,无需上传文件,安全私密。