图片文字识别
使用本地 OCR 引擎从单张图片中提取印刷文字。图片保留在当前浏览器中,请选择图片的主要语言。
使用步骤
如何使用
- 选择一张不超过 3 MB、4 百万像素的 JPEG、PNG 或 WebP 图片。
- 选择图片中的主要语言并开始识别。OCR 引擎和语言数据会在需要时从本站加载。
- 检查并编辑识别结果,然后复制或下载 UTF-8 文本文件。
本地 OCR,支持四种语言模型
识别通过 Tesseract.js 和本站提供的语言数据在你的设备上运行。图片不会上传,也不会发送到 AI 服务。支持英文、简体中文、日文和韩文,请选择图片中的主要语言。
限制图片与文本大小
支持一张不超过 3 MB、4 百万像素的 JPEG、PNG 或 WebP 图片。结果超过 120,000 个字符时会拒绝输出,不会静默截断。首次使用时,OCR 引擎和所选压缩语言模型会从本站下载,并可能缓存在浏览器中。
OCR 不是准确抄录保证
识别质量受清晰度、对比度、方向、字体、手写内容和语言影响。此版本面向清晰的印刷文字,不翻译、不保留版面、不提取文档字段,也不保证准确。请在使用前核对结果。
常见问题
你可能还想知道
图片会上传吗?
不会。图片由你设备上的浏览器工作线程解码和处理。只有 OCR 引擎代码和所选语言模型会从 tools.hellokeyboard.com 下载。
支持哪些识别语言?
可选择英文、简体中文、日文或韩文。请选择图片中占主要部分的语言;工具不会翻译。
为什么第一次运行比较慢?
浏览器需要从本站加载 OCR 引擎和所选语言模型。Tesseract.js 可能会将它们缓存在当前浏览器,以便后续使用。
能识别手写内容或保留页面布局吗?
工具面向印刷文字,并返回可编辑的纯文本。手写、分栏、表格、旋转和特殊字体可能降低准确度或影响阅读顺序。