文档扫描与 OCR 转换器

本地扫描与 OCR

无需上传即可清理本地扫描件、识别中英文并导出可搜索文档。

0 / 40 页

打开图片或 PDF,或载入自动生成的扫描示例。

使用方法

  1. 01

    导入并整理页面

    打开图片或受限 PDF,在浏览器中排序、复制、删除、旋转和预览页面。

  2. 02

    清理并识别

    应用裁剪与扫描滤镜、估算纠偏角度,再对单页或完整文档运行本地 Tesseract OCR。

  3. 03

    复核并导出

    编辑识别文字、检查置信度与低置信词,并导出文本、证据格式或可搜索 PDF。

常见问题

文档会上传吗?

不会。PDF 栅格化、图片滤镜、OCR 与导出都在本地完成;语言和 WASM 资源随静态应用提供。

支持哪些语言?

内置模型支持英文、简体中文,或中英文混合识别。

可搜索文字能完美对齐吗?

不能保证。OCR 根据检测布局重建文本,关键内容必须结合扫描图和置信度复核。

为什么限制文件和页数?

PDF 渲染和 OCR 占用大量内存;100 MiB 和 40 页上限可以保护浏览器并保持 Cloudflare Pages 静态流程稳定。

继续使用其他专注的浏览器端工具。

全部工具

默认本地处理;远程数据来源会明确说明。

© 2026 Nobuf

Nobuf

由浏览器驱动的快速、本地优先实用工具。