우리가 탐지하는 것
이미지 텍스트 (OCR)
이미지, 스크린샷 및 사진에서 텍스트를 추출하고 분석합니다.
QR 코드
QR 코드를 디코딩하여 숨겨진 링크와 스팸 콘텐츠를 드러냅니다.
일반적인 탐지
- 지갑 주소가 포함된 암호화 사기 이미지
- 피싱 사이트로 연결되는 QR 코드
- 스팸 텍스트가 포함된 홍보 이미지
- 스팸 메시지의 스크린샷
이미지에서 텍스트와 코드를 추출하는 방식
스패머는 텍스트 필터를 피하려고 정확히 그 목적으로 페이로드를 사진 속으로 옮기므로, Telm은 이미지도 읽습니다. 모든 이미지는 OCR — 광학 문자 인식 — 을 거쳐, 암호화폐 사기 그래픽 속 지갑 주소든, 사진 위에 쓴 홍보 문구든, 스팸 메시지의 스크린샷이든, 그 안에 담긴 모든 텍스트를 추출합니다. 동시에 모든 QR 코드가 디코딩되어 그 안에 숨겨진 링크를 드러냅니다. 이는 흔히 이미지가 평문으로는 절대 보여주지 않는 피싱이나 악성코드 목적지입니다. 추출된 텍스트와 디코딩된 링크는 일반 메시지를 판단하는 것과 동일한 파이프라인으로 다시 공급되므로, 이미지 스팸은 실제 내용에 따라 평가됩니다.
이는 텍스트 전용 방어의 명백한 허점을 메우며 모든 이미지에서 자동으로 작동하고, 가벼운 재인코딩이 된 경우에도 이전에 본 사진을 인식하는 지각 이미지 해싱과 나란히 작동합니다. 인식은 여덟 개 언어를 다룹니다 — 영어, 러시아어, 독일어, 프랑스어, 스페인어, 중국어, 일본어, 한국어 — 여기에 솔직한 한계가 있습니다: OCR은 심하게 꾸며진 글꼴, 왜곡된 텍스트, 매우 저해상도인 이미지에서 완벽하지 않으며, 그 집합 밖의 문자는 옮겨 적히지 않습니다. 이는 사진 속에 어떤 텍스트도 숨을 수 없다는 보장이 아니라 강력한 추가 계층이며, 그래서 단독으로 결정하는 대신 더 넓은 파이프라인에 공급됩니다.
자주 묻는 질문
모든 이미지를 스캔하면 그룹이 느려지거나 비용이 드나요?
스캔은 이미지가 도착할 때 백그라운드에서 자동으로 실행되므로, 멤버는 대화를 이어가기 위해 그것을 기다리지 않습니다. 이는 별도의 유료 부가 기능이 아니라 보호 파이프라인의 일부입니다. 지각 이미지 해싱은 또한 이미 보고 판단한 사진을 다시 빠르게 인식하게 해주므로, 반복되는 스팸 이미지가 매번 전체 재분석을 필요로 하지 않습니다.
OCR이 정상 이미지를 잘못 읽어 무고한 게시물을 표시하지 않을까요?
OCR은 텍스트를 추출할 뿐 스스로 결정하지 않습니다. 추출된 단어와 디코딩된 QR 링크는 일반 메시지와 동일한 탐지 파이프라인을 거치므로, 텍스트가 담긴 무해한 밈은 그 텍스트가 실제로 무엇을 말하는지에 따라 판단됩니다. 모든 탐지와 마찬가지로 애매한 판정은 기록되어 검토할 수 있으며, 집행을 켜기 전에 모니터링 모드에서 지켜볼 수 있습니다.
실제로 어떤 언어를 읽을 수 있나요?
인식은 여덟 개 언어를 다룹니다: 영어, 러시아어, 독일어, 프랑스어, 스페인어, 중국어, 일본어, 한국어입니다. 그 집합 밖의 언어로 된 텍스트는 안정적으로 옮겨 적히지 않으며, 심하게 꾸며진 글꼴, 왜곡된 글자, 매우 저해상도인 스크린샷은 OCR을 무력화할 수 있습니다 — 이것이 OCR이 독립형 필터가 아니라 더 넓은 파이프라인에 공급하는 계층으로 작동하는 한 가지 이유입니다.
스패머가 이미지 속 텍스트를 왜곡해서 OCR을 뚫을 수 있나요?
때때로 그렇습니다 — 의도적으로 뒤틀거나 노이즈를 넣은 텍스트는 바로 OCR이 어려워하는 것이며, 작정한 스패머는 인식을 방해하려고 이미지를 열화시킬 수 있습니다. 그래서 OCR은 단독으로 서지 않습니다: QR 디코딩은 코드로 숨겨진 링크를 잡고, 지각 해싱은 재사용된 이미지를 잡으며, AI 파이프라인은 복원된 텍스트가 무엇이든 판단하므로, 한 계층을 뚫는다고 해서 전부를 통과하는 것은 아닙니다.
관련 기능
Telm이 커뮤니티를 도울 수 있는 다른 방법을 알아보세요