格式
校验真实文件头
文件上限
10 MB
每份文档
结果
结构化
文字与版面
PDF OCR
方便逐项核对的 PDF 识别
检查每段提取内容时,原始文档始终可见。
PDF 文件头校验
开始识别前必须确认文件包含真实 PDF 头。
按页组织结果
供应商提供时,结果包含页数和逐页版面内容块。
公式与表格视图
结构化内容可以和完整 Markdown 分开检查。
没有云端历史库
应用数据库不保留上传的 PDF 或 OCR 文本。
PDF OCR 适用场景
从只能看、不能复制的 PDF 中恢复可用文字。
扫描报告
从扫描报告中恢复标题、段落和表格型内容。
页面按顺序识别
学术 PDF
从图片型阅读资料中提取文字和公式。
公式独立视图
表单与说明书
把归档表单和纸质说明书转换成可编辑 Markdown。
Markdown可直接下载
PDF OCR 常见问题
当前文件、隐私和计费边界。