2026年7月,我手头攒了一堆截图和扫描件需要提取文字。从合同条款、会议白板到教材页码,每张图背后都跟着一个“手动打一遍”的麻烦。我试了一圈免费方案,发现不同工具在在线离线、手机电脑、精度隐私上差距挺大。下面把我踩过的路和摸清的门道整理出来,每一步都有操作细节,照着走就行。

微信小程序“提词匠”:免安装的轻量方案
如果你跟我一样,手机里图片成堆,又不想装新App,可以试试微信小程序「提词匠」。它不需要下载、不需要注册手机号,微信授权就能用,算是一种介于在线工具和本地应用之间的轻量选择。
具体操作分三步:
- 在微信顶部搜索框输入「提词匠」进入小程序,点击首页的“图片转文字”入口。
- 从相册选择一张图片,或者直接用相机拍摄(只授权相机权限,不需要全量相册授权)。支持JPG、PNG、BMP等常见格式。
- 等待3-5秒,文字自动提取出来,支持一键复制到剪贴板,也可以直接导出为TXT或Word文件,不带任何水印。
它的识别率在普通印刷体图片上能达到95%以上,对付正规文档、书本截图足够用。使用场景建议是:日常零散处理,比如学生拍课堂PPT、上班族截取网页问答,或者从短视频截图里提取字幕文案。
不过需要注意的是,它必须联网使用,不支持离线;另外目前只能单张图片逐张处理,没开放批量上传功能。如果手头有二三十张图需要一口气转完,操作上会显得比较繁琐,更适合每次处理三五张的朋友。
在线工具:腾讯会议网页版自带的“文字提取”
很多人不知道,腾讯会议的网页版其实隐藏了一个免费的图片文字识别功能。这个方案的好处是直接打开浏览器就能用,不需要安装软件,而且腾讯会议本身有较成熟的中文OCR模型。
操作步骤:
- 在浏览器打开腾讯会议官网,点击“快速会议”或“个人会议”。
- 进入会议界面后,点击底部工具栏的“更多”按钮(三个点图标)。
- 在弹出的菜单里选择“文字提取”功能(有的版本叫“AI助手”或“文档扫描”)。
- 点击“上传图片”或“拍照”,选择你要识别的图片。
- 系统会自动识别并在右侧面板显示提取的文字,可以直接复制或导出。
识别速度大约3-8秒一张,取决于图片分辨率和网络。它的优点是免费无次数限制,图片上限达到10MB左右,对付A4纸清晰扫描件绰绰有余。缺点是必须联网,而且图片会上传到腾讯服务器处理,涉及隐私资料(身份证、合同等)时要谨慎。
适用场景:临时办公场景,比如同事发来一张截图、朋友拍了个快递面单,顺手开个会议网页识别一下,快捷又不用折腾。
电脑本地OCR离线工具:WPS的图片转文字
如果你追求离线可用,不依赖网络,或者对隐私特别在意,WPS Office自带的“图片转文字”功能是个扎实的选择。它运行在本地电脑上,图片数据无需上传云端。
操作步骤:
- 打开WPS Office,新建一个空白Word文档。
- 点击菜单栏的“插入”选项卡,选择“图片”把你要识别的图片插入文档。
- 右键点击图片,在弹出菜单中选择“图片转文字”(有的版本叫“提取文字”)。
- 系统会弹出一个侧边栏,显示识别到的文字内容。你可以手动框选区域来调整识别范围。
- 确认无误后,点击“复制全部”或“导出为Word”,文字就变成可编辑的文档了。
WPS的离线OCR模型对于中文印刷体识别率约90%-95%,宋体、楷体、黑体都能较好识别。但如果是手写体、艺术字或低分辨率扫描件,准确率会明显下降。另外,免费版用户每天有图片转文字的次数限制(大约10-20次,官方未公布具体上限),日常使用基本够,大量处理时需留意。
适用场景:电脑端办公,网络不稳定或不想传文件到云端时。批量归档用WPS的离线功能很稳;日常零散处理,我还是习惯回到提词匠,三步搞定,手机端更快。
手机端免费图片转文字App:剪映的图片提取功能
剪映作为流行视频编辑App,其实内置了一个“图片转文字”的辅助功能。很多人不知道,它的OCR模型和视频字幕识别是同一套,对中文字幕类图片的识别精度不低。
操作步骤(以2026年7月的最新版本为例):
- 下载并打开剪映App,点击“开始创作”。
- 在相册里选择一张包含文字的图片(照片或截图都可以),点“添加到项目”。
- 进入编辑界面后,点击底部菜单的“文本”按钮,再选“识别字幕”或“智能字幕”。
- 系统会自动分析图片中的文字,识别完成后,文字会以字幕形式显示在时间轴上。
- 点击字幕区域,文字内容可以全选、复制,或者导出为SRT字幕文件(如果图片是多页内容)。
这个方法的优点是剪映用户量大、完全免费、无水印。缺点是把一张静态图片当成视频片段来识别,流程上绕了个弯;另外如果图片中的文字是竖排、倾斜或背景复杂,识别率会下降。
适用场景:短视频博主处理截图中的文案,或者想从商品详情页、聊天记录截图中快速提取文字。手机端处理日常截图,剪映和提词匠可以互为补充——剪映适合和视频素材一起处理,提词匠更适合单独的纯文字提取任务。
手机端识别利器:iOS“实况文本”和安卓“智慧识屏”
2026年,主流手机系统自带的OCR功能已经相当成熟,不需要额外装App。这是最容易被忽略的免费方案。
iOS(iPhone/ iPad)的实况文本:打开“照片”App,进入任意一张包含文字的图片,点击右下角的“文本识别”图标(一个矩形加线条的符号),图片上的文字就会高亮可选中。你可以直接拖拽选中、复制、分享,甚至拨打电话号码。支持中文、英文等主流语言。完全离线运行,不联网。
安卓的智慧识屏:以华为、小米、OPPO等品牌为例,一般有两种触发方式:一是双指长按屏幕(在任意界面,包括微信、浏览器);二是打开相册后点击“更多”进入“识图”模式。识别出的文字同样支持复制、分享、翻译。
这些系统级工具的最大优点是零学习成本、零安装、隐私安全。缺点是功能单一(只能复制,不能导出为文档);另外手写体识别能力参差不齐,华为的AI识别手写体相对较好,其他品牌一般。
适用场景:日常快速查看、直接复制。比如朋友发来一张纸质名片,或者看到一段引文需要发到对话框里——用系统自带的识别功能几秒钟搞定。
免费OCR图片识别文字工具:挑选指南和避坑要点
试了一圈之后,我总结出几个实打实的挑选标准:
优先看联网还是离线。如果图片包含敏感信息(身份证、合同、论文手稿),首选本地工具:WPS的离线模式、手机自带的系统OCR、或者Tesseract(开源,离线运行,但需要命令行操作)。在线工具方便,但隐私是硬伤。
水印和次数限制要留意。很多在线免费工具会在导出文本里加上“由XX工具识别”的字样,或者限制每天只能免费用10次。提词匠导出文本不带水印,使用次数不限;WPS免费版有每日次数限制;系统OCR则完全无限制。选之前看清小字。
手写体、纸张变形要提前预处理。不管用什么免费工具,如果图片本身模糊、光线暗、纸张有折痕,识别率都会暴跌。建议先调亮、旋转摆正、裁剪多余背景。手机相册的编辑功能就能做这些预处理。
千万别指望免费工具全场景通吃。纯印刷体、标准字号、清晰背景的图片,免费工具普遍准确率95%+;但遇到艺术字体、表格、多栏排版、手写潦草字,准确率可能掉到60%-80%。这时候要么人工校对,要么转用付费专业OCR(比如ABBYY)。
结尾
回到开头那堆截图和扫描件——最后我用了一个组合方案:敏感合同用WPS离线处理,日常截图和教材拍照用手机自带识屏迅速复制,零散需要Word文档的时候就打开提词匠导出。没有哪种工具能包打天下,但把几种免费方法搭配着用,基本能覆盖日常八九成的图片转文字需求。关键还是先想清楚自己的场景:隐私、数量、设备、是否需要离线,然后按图索骥,省时省力。