截图能框准、标注能画上,并不等于图上的字能被拿走。很多人打开识别后,得到一堆错字、少行、英文和数字黏在一起,或界面上根本没有识别入口,于是以为软件没有文字识别。Snipaste 的识别依附在已经截好或已经钉住的图像上,识别的是像素里的字形,不是文档里的可编辑图层。图糊、字太小、背景花、斜向排版、艺术字,都会直接变成错字。下面只讲这一件事:怎样把图上的字稳定地取出来,并在复制前把常见错误改掉。
先确认当前这张图具备识别条件
1. 必须先有一张成功落下的图
没有完成过一次成功截图或贴图,识别没有工作对象。成功是指图像已经进入剪贴板、已经保存成文件,或已经钉在桌面上。只框一下就取消,历史里不会留下可供识别的记录。正确顺序是先按截图键框住文字区域,用中键或贴到屏幕的快捷键把图钉住,再对这张图做识别,而不是在全屏桌面上凭空找识别按钮。
2. 文字区域要单独框,不要带着大块无关界面
整窗截进去再识别,工具栏图标、按钮、装饰线都会被当成“字”。识别引擎会把邻近的图形噪声拼进结果,表现为多出奇怪符号、把图标读成字母。需要某段说明时,只框这一段;需要表格里一列数字时,只框这一列。多段不相邻的文字,分两次截、分两次识别,不要指望一次框住整页就按阅读顺序完美排出来。
3. 先把贴图缩放到接近原始大小
钉在桌面上的图如果被滚轮放得很大或缩得很小,屏幕上看到的是插值后的边,识别采样会发虚。先用中键把尺寸和透明度复位,再启动识别。高分屏上把普通屏截来的字放到百分之二百查看时,若开启了平滑缩放,笔画会发糊,识别更容易把“明”读成“朋”。需要看清再识别时,宁可先复位再识别,不要在放大预览态直接取字。
识别前把画面处理到“机器能看清”
1. 对比度不够时先不要硬识
浅灰字印在浅底上、深色字叠在照片上,人眼勉强能读,模型却会漏画。能在原界面把主题改成高对比再截,就不要对着浅色主题硬识。不能改主题时,把选区收紧到文字本身,减少背景图案进入框内。阴影、水印、半透明遮罩会把同一笔画切成深浅两截,识别结果里常见多一横、少一点。
2. 斜的、弯的、艺术字先当例外
水平印刷体、界面默认字体、代码编辑器里的等宽字,是识别最稳的一类。标题里拉斜的艺术字、带描边的海报字、手写批注,错误率会明显升高。这类内容不要指望一次识别当正文用,只适合抽关键词,再手工补全。需要整段准确时,回到能复制的原窗口去选文字,识别只做原窗口禁止复制时的退路。
3. 中英混排、数字编号要预留校对时间
界面里“V2.0”“O0”“Il”混在一起时,字母和数字最容易对调。中文里带英文按钮名称,行序有时会被拆乱。识别完成后不要直接发给别人,先在结果里扫一遍数字、版本号、路径、快捷键名称,这些位置错一个字符就会让整篇教程作废。
按固定步骤取出文字,避免点错对象
1. 对着贴图或截图结果启动识别,而不是对着正在变化的活窗口
滚动中的网页、正在刷新的后台、会闪动的提示条,像素在变,识别等于对着动画拍照。先钉住当前帧,画面静止后再识。需要下一屏文字,滚动后再截一张新的,不要在同一张已钉住的旧图上期待出现新内容。
2. 只圈文字,不圈装饰
启动识别后,把范围收在字的外接矩形以内,上下左右各留很少空白即可。框进一条彩色竖线,结果里常多出一个“1”或“l”。框进圆形图标,可能冒出“O”。宁可少框一行,漏的那行再识一次,也不要为了省事把整栏控件吃进去。
3. 复制前先在识别结果里改,不要复制出去再在别处改
结果框里改一个错字,成本最低。复制到聊天窗口后再改,格式和换行往往会再乱一次。改完再复制。若这张贴图本身就是由纯文本生成的,可以用复制纯文本的组合键直接拿走原文,不必走图像识别。图像识别只处理“画面上的字”,文本贴图上的字本来就在剪贴板链路里。
识别结果乱、空、少行时按原因处理
1. 结果是空的
先看框里到底有没有足够大的字。字高只有几个像素,或整段被压缩成一条细线,引擎会放弃。把原界面字号开大,或把窗口拉宽再截。其次看图是不是纯色块、是不是被马赛克盖过。已经打上马赛克的区域不可能再读出隐私内容,这是正常结果,不要反复识同一块马赛克。
2. 结果有字但错得离谱
多半是糊、斜、背景花。复位贴图大小后重识;仍差,就回到原界面放大窗口再截一张更清晰的。同一段字不要在已经标注过箭头和色块的成品图上识别,标注线会当成笔画。用未标注的底图去识,标注另存在副本上。
3. 行序乱、段落黏在一起
多栏布局、卡片式排列、文字绕着图片走时,识别常常按坐标从上到下“锯”字,不会按你阅读的视觉流走。对策是按阅读顺序一块一块框,每块单独复制,在编辑器里自己排段。不要对复杂排版的整页一次识别,再指望自动变成一篇结构正确的文章。
把识别嵌进日常截图流程里,而不是当成独立魔术
1. 做教程时:先识字,再标注
需要把界面说明做成图文教程,先对干净截图做识别,把按钮名称、报错原文拷进文稿,再在另一份副本上画箭头和马赛克。先画后识,字会被线切开。报错代码、路径、配置项尤其要走识别加人工核对,不要凭记忆手打。
2. 做对照时:两张图分别识,不要靠眼睛扫
两个版本的设置页看起来差不多,真正差的往往是某一项后面的数字或单位。两张都钉在桌面上,分别识别同一位置,把两段结果贴在一起比对,比在两张图之间来回盯更不容易漏。
3. 原窗口允许直接复制时,不要用识别凑合
能在网页里划词、能在编辑器里复制,就直接复制。识别是对付“界面禁止选中、只渲染成图、或只有一张别人发来的截图”的情况。把它当默认输入法,会把错误率带进所有文稿。
核对清单:复制走之前只问这几句
数字、版本号、文件路径、快捷键是否和画面一致。中文有没有缺笔画的形近字。英文专有名词大小写是否被改乱。换行是否把一句话从中间切断。若这几处都过得去,这段识别才值得贴进文档。过不去就只采用其中能对上画面的短词,其余对着原图手补。识别解决的是“把像素变成可粘贴的字符”,准确率仍然要靠最后一次对照画面来托底。把框选收紧、画面静止、大小复位、先识后标这四步做成习惯,空结果和乱码会少一大半,剩下的才是真正需要人工改的那几个形近字。

