图片转文字(OCR)
用浏览器本地运行的 AI 模型,从截图、扫描件、照片中提取文字。免费、不限次数、图片不上传。
把图片拖到这里,或点击选择
本地处理 —— 不会上传任何内容
如何从图片中提取文字
把照片、截图或扫描件拖进框里。清晰、光线充足的印刷体图片效果最好。图片只留在这个标签页,绝不上传。
选择文字语言 —— 默认选中页面语言,可切换到 14 种支持语言中的任意一种。首次使用时 AI 模型(约 4 MB)下载一次,之后完全在你的浏览器里运行。
点击「提取文字」。识别出的文字出现在图片下方,每个词都有高亮框。可以复制到剪贴板,或下载为 TXT 文件。
实用技巧
从纸质档案到可搜索文本:为什么 OCR 完胜手打
扫描件在文字被提取之前,对搜索而言就是死档。一文件夹的合同、发票、会议记录扫描图,只有 OCR 把像素变回字符后才能被检索。本工具在浏览器里完成这件事:拖入扫描件、复制文字、粘贴进你的笔记或文档系统,从此任何关键词都能搜到它。因为识别全程在你设备上进行,私密文件不会经过第三方服务器 —— 对发票、税务文件、保密协议尤其重要。过去要逐页手打的流程现在只需几秒,图片上的词框高亮还能让你在信任结果前先逐字核对。 它本质上是一个住在你标签页里的图片转文字转换器——无需上传、无需排队、无需刷新页面。
截图就是新时代的复制粘贴:随处摘录
很多 App、PDF 阅读器和网页会禁止选中文字。过去的笨办法是手打 —— 直到你发现截图几秒就能转文字。截下段落、拖进来,文字就出现在输出框里,随时粘贴进文档、聊天或翻译工具。研究者天天用它从论文和锁定 PDF 里摘引文;客服用它从截图里抓报错信息和订单号。词框高亮把模型读到的内容画在图上,重要内容复制前一眼就能看出哪个字可能读错。
OCR 能读什么、不能读什么:动手前先校准预期
模型在良好条件下读印刷体:文字与背景对比度足够、角度大致端正、字号至少 10-15 像素高。大角度斜拍、运动模糊、花体字、复杂背景上的文字都会出错 —— 置信度会如实反映。想获得最佳效果,就把图片裁到只剩文字本身,并确保对焦清晰。也请记住它的诚实边界:本模型不读手写。需要转录手写笔记是另一个更难的问题;本工具只为印刷体而生。
常见问题
这个图片转文字工具真的免费吗?+
是的。AI 模型在你的浏览器里运行 —— 没有服务器,就没有收费的理由,也不限制处理数量。无需账号,几百张截图随便转。
我的图片会被上传到服务器吗?+
不会。图片、AI 模型和识别结果都不离开你的设备。这很重要 —— 合同、病历、未发布的作品等私密文档里的文字,全程不出你的电脑。
支持识别哪些语言?+
14 种语言:英语、中文、日语、韩语、俄语、西班牙语、葡萄牙语、德语、法语、阿拉伯语、印地语、泰语、越南语、印尼语。提取前选好文字的语言 —— 混排文档一次选一种语言效果最好。
能识别手写文字吗?+
不能。模型只针对印刷体训练 —— 文档、截图、路牌、字幕。手写体因人而异、差异太大,可靠识别不现实,所以本工具诚实地说:只做印刷体。手写笔记请用专门的手写识别服务。
识别准确率怎么样?+
清晰的印刷体上,英文准确率约 95%,多数其他语言 90% 以上。模糊、小字、歪斜拍摄会降低准确率 —— 每次识别后显示的平均置信度就是模型对自己的把握。
能读截图里的文字吗?+
能——截图是它最常见的用法之一。截下聊天记录、锁定 PDF 或 App 报错信息,工具几秒内把它变成可编辑文字。词框高亮还标出了每段文字在屏幕上的位置。