跳到主要内容
OCR

图像文字
识别

从图像和二维码中提取和分析文本,检测隐藏的垃圾信息。

  • 图像文本提取
  • 二维码扫描
  • 多语言
上传的图片提取出文字垃圾信息被拦截

我们检测的内容

图像文本 (OCR)

从图像、截图和照片中提取和分析文本。

二维码

解码二维码以揭示隐藏的链接和垃圾内容。

8
识别语言——英语、俄语、德语、法语、西班牙语、中文、日语、韩语
自动
每一张图片都会被扫描
协同
与图像哈希协同工作

常见捕获

  • 带有钱包地址的加密诈骗图像
  • 链接到钓鱼网站的二维码
  • 带有垃圾文本的宣传图像
  • 垃圾消息的截图

文字与代码如何从图片中提取

垃圾发送者把有害内容移进图片,正是为了避开文字过滤器,因此 Telm 也会读取图片。每一张图片都会经过 OCR——光学字符识别——以提取其中的任何文字,无论那是加密骗局图里的钱包地址、写在照片上的推广语,还是一张垃圾消息的截图。与此并行,任何二维码都会被解码,以揭示其中隐藏的链接,那往往是图片从不以明文显示的钓鱼或恶意软件目标地址。提取出的文字与解码出的链接随后会被送回判断普通消息的同一条流水线,因此图片垃圾会按其实际内容来评估。

这堵住了任何纯文字防御中显而易见的缺口,并对每一张图片自动生效,同时配合感知图像哈希——即便一张图片被轻度重新编码,也能认出此前见过的它。识别覆盖八种语言——英语、俄语、德语、法语、西班牙语、中文、日语和韩语——诚实的局限也正在于此:OCR 对高度风格化的字体、扭曲的文字或极低分辨率的图片并不完美,而这套语言范围之外的文字不会被转写。它是一层强有力的额外防护,而非“任何文字都无法藏进图片”的保证,这正是它汇入更广流水线、而非独自决断的原因。

常见问题

扫描每一张图片会拖慢我的群组或让我付出代价吗?

扫描会在图片到达时于后台自动运行;成员无需等它才能继续聊天。它是防护流水线的一部分,而非另行收费的附加项。感知图像哈希还让一张已经见过并判断过的图片能被再次快速认出,因此重复出现的垃圾图片不必每张都进行完整的重新分析。

OCR 会误读正常图片、把无辜的帖子误判吗?

OCR 只提取文字,它本身不做决定。提取出的词语和任何解码出的二维码链接,都会被送入与普通消息相同的检测流水线,因此一张带文字的无害表情包会按那段文字的实际含义来判断。与所有检测一样,模棱两可的判定都会被记录且可复查,你也可以在开启执行之前于监控模式下观察它。

它究竟能读懂哪些语言?

识别覆盖八种语言:英语、俄语、德语、法语、西班牙语、中文、日语和韩语。这套语言范围之外的文字不会被可靠地转写,而高度风格化的字体、扭曲的字形或极低分辨率的截图都可能让 OCR 失效——这也是它作为汇入更广流水线的一层、而非独立过滤器来工作的原因之一。

垃圾发送者能靠扭曲图片中的文字来击败 OCR 吗?

有时能——刻意扭曲或加噪的文字正是 OCR 最难处理的,一个铁了心的垃圾发送者可以劣化一张图片来削弱识别。这正是 OCR 不单打独斗的原因:二维码解码能抓住藏成代码的链接,感知哈希能抓住被重复使用的图片,而 AI 流水线会判断恢复出来的任何文字,因此击败一层并不等于闯过全部。

准备好开始了吗?

立即开始保护您的社区。提供免费计划。