IMAGE → TEXT · OCR
图片转文字 — 隐私 OCR
从照片和屏幕截图中提取文字。复制文字或下载文本文件,全部在浏览器中完成。
添加图片
JPG · PNG · WebP · BMP
您也可以使用 Ctrl+V 或 ⌘V 粘贴屏幕截图。如果无法访问剪贴板,请选择图片文件。
最多 20 张图片,每个文件 20 MB,总计 100 MB,每张图片最多 4000 万像素。
选择图片中的文字语言。重新提取会替换之前的结果。
识别结果
提取的文字将显示在这里。添加图片即可开始。
适合清晰的印刷文字和屏幕截图。手写文字或复杂排版的识别效果可能不佳。使用前请检查并编辑结果。
图片和文字始终保留在您的设备上。识别工具和语言文件从 ItsyTools 加载。仅语言文件会被缓存;本工具不保存您的图片或文字。
从图片中提取并核对文字
使用私密 OCR,将截图、照片或扫描页面转换为可复制或保存的文本。识别在您的设备上运行。清晰的印刷文字效果最好;结果是需要复核的转录内容,并不保证每个字符、表格或阅读顺序都正确。
操作步骤
- 添加 JPG、PNG、WebP 或 BMP 图片,或在浏览器允许访问剪贴板时粘贴图片。选择图片中正文的语言;该设置与网站界面语言相互独立。
- 开始识别,等待引擎加载并处理图片。保持标签页打开。逐一选择批次中的结果,将姓名、日期、金额和标点与原图比较。
- 复制或下载前,请修正识别的文本。可以将单个结果保存为文本,或为已完成的文件下载合并文本。核对完转录内容前,请保留原始图片。
设置与限制
- 识别语言与加载
- 选择与印刷文字匹配的模型。首次使用时,网站会将 OCR 引擎和语言模型提供给浏览器下载;此下载并不是上传您的图片。已缓存的资源并不保证每种语言都能离线使用。
- 输入限制
- 最多添加 20 张图片,每张不超过 20,000,000 字节,总计不超过 100,000,000 字节。每张图片不得超过 40,000,000 像素,任意一边不得超过 20,000 像素。不直接接受 PDF 文件;请先使用“PDF 转图片”。
- 准确性与缩小图片
- 识别前,大图片会缩小至最长边不超过 3,200 像素、总像素数约为 8,000,000。裁掉无关区域,使用摆正、清晰且对比度高的文字。手写文字、反光、分栏和表格可能导致不可靠的结果。
操作示例
下载 ocr-sample.png,并选择英语作为识别语言。运行 OCR,将转录结果与 ocr-expected.txt 比较;示例包含 3 行清晰的印刷文字。
预期结果
ITSYTOOLS SAMPLE
Invoice 204
Total 12.50检查结果中是否包含 ITSYTOOLS SAMPLE、Invoice 204 和 Total 12.50,并确认数字一致。空白字符和换行可能不同。将文本用于其他文档前,请修正所有差异。
常见问题与故障排查
为什么字母或数字识别错误?
OCR 根据可见像素推测字符。请尝试更清晰的扫描图、裁切至更靠近文本的范围,并选择正确语言。务必核对 O 和 0 等相似字符,尤其是在账号和金额中。
为什么文字顺序错误?
分栏、表单和表格可能扰乱阅读顺序。请每次识别一个裁切后的区域,并自行重建结构。纯文本下载不会保留电子表格单元格或原始页面布局。
为什么识别停止或无法开始?
模型下载、工作线程启动或内存占用过大的图片都可能导致失败。请检查初次下载引擎时的网络连接,尝试较小的图片或批次,然后重试。取消后,已完成的结果可能仍可用。