Vai al contenuto principale

Rilevamento OCR dello spam nelle immagini in Telm

Come Telm legge il testo all’interno delle immagini, riconosce i banner di spam noti e decodifica i codici QR così lo spam solo-immagine viene catturato con la stessa rapidità del testo semplice.

6 min di lettura
In breve

Gli spammer sono passati dal testo alle immagini perché i bot basati su semplici parole chiave ne sono ciechi. Telm controlla ogni immagine in tre modi contemporaneamente: un hash percettivo riconosce i banner di spam noti anche dopo ridimensionamento o ricolorazione, l’OCR legge il testo stampato all’interno dell’immagine e un decodificatore QR estrae link e numeri di telefono nascosti. Il testo estratto da un’immagine passa attraverso le stesse regole antispam dei messaggi normali, così un banner di casinò con un codice QR viene rimosso con la stessa rapidità di un annuncio testuale.

La gestione delle immagini si trova nei Filtri dei contenuti; il testo dentro le immagini viene letto automaticamente.

Vuoi configurarlo? Fallo direttamente nel tuo account Telm.

Apri nella dashboard

1Perché lo spam si nasconde nelle immagini

Un classico filtro a parole chiave guarda solo al testo del messaggio, così gli spammer mettono la loro offerta in un’immagine: un banner di casinò, uno screenshot di investimento, un codice QR che porta a un canale truffa. A un bot ingenuo il messaggio sembra vuoto e innocuo.

Telm tratta un’immagine come contenuto da leggere, non come un allegato opaco. Ogni foto viene ispezionata mentre girano gli altri controlli, così lo spam nelle immagini viene fermato nello stesso passaggio dello spam testuale.

2Come Telm legge il testo all’interno di un’immagine

L’OCR (riconoscimento ottico dei caratteri) trasforma le lettere stampate su un’immagine di nuovo in testo. Telm legge con il motore Tesseract, ottimizzato per le lingue che la Sua community effettivamente parla.

Una volta estratto il testo, un’immagine insolitamente ricca di testo viene trattata come un probabile annuncio, e le parole recuperate vengono fatte passare attraverso le Sue normali regole antispam. Se quelle regole trovano corrispondenza, l’immagine riceve un punteggio proprio come un messaggio testuale che avesse detto la stessa cosa.

  • Lettura multilingue pronta all’uso — inglese e russo per impostazione predefinita, più tedesco, francese, spagnolo e CJK (cinese, giapponese, coreano).
  • Un’immagine ricca di testo (molte parole stampate con buona confidenza) è di per sé un segnale di spam.
  • Il testo recuperato viene ricontrollato rispetto all’intera libreria di regole, così le offerte nascoste nei banner vengono catturate.
  • I risultati vengono ricordati tramite l’impronta dell’immagine, così la stessa immagine non viene mai elaborata due volte.

3Tre controlli su ogni immagine

L’OCR è uno dei tre controlli che girano insieme su ciascuna immagine. Tra loro coprono i banner riutilizzati, il testo stampato e i link codificati.

  • Hash percettivo — riconosce un banner di spam noto anche dopo che è stato ridimensionato, ritagliato o ricolorato. Un’immagine segnalata come spam in un gruppo viene riconosciuta in tutti i gruppi.
  • OCR — legge il testo stampato all’interno dell’immagine e lo fa passare attraverso le regole antispam.
  • Decodificatore QR — estrae link (compresi t.me, wa.me e telegram.me) e numeri di telefono nascosti in un codice QR, e segnala le destinazioni sospette.
Il database delle immagini di spam è globale: una volta che un banner è contrassegnato come spam in un qualsiasi gruppo protetto, Telm lo conosce ovunque. Vedi come funziona il rilevamento dello spam per l’intera pipeline.

4Quando entra in gioco la visione AI

I controlli rapidi qui sopra risolvono la maggior parte delle immagini da soli. Per la vera zona grigia — un’immagine che non è né un banner noto evidente né evidentemente pulita — Telm può passare a un modello di visione AI che descrive ciò che l’immagine mostra realmente.

Questo sguardo più profondo è riservato a quei casi limite, quindi entra in gioco solo quando i segnali più rapidi sono inconcludenti.

L’hashing percettivo, l’OCR e la decodifica QR girano su ogni piano come parte del motore principale. L’escalation alla visione AI fa parte della moderazione AI, disponibile su Pro e Business.

5Cosa controlla Lei

Il rilevamento intelligente delle immagini non richiede alcuna configurazione — è attivo non appena il bot applica la moderazione. Se la Sua community non dovrebbe pubblicare immagini affatto, può anche applicare un blocco netto che elimina ogni immagine a prescindere dal contenuto.

I due approcci sono indipendenti: il rilevamento intelligente rimuove le immagini spam lasciando passare le foto normali; il filtro netto rimuove tutte le immagini. La maggior parte dei gruppi vuole solo il rilevamento intelligente.

  • Rilevamento intelligente (hash + OCR + QR) — mantiene le foto reali, rimuove lo spam nelle immagini. Attivo per impostazione predefinita.
  • Blocca tutte le immagini — un filtro netto per le comunità solo-testo. Veda filtri dei contenuti.
Questo articolo ti è stato utile?

Pronto a proteggere il tuo gruppo?

Aggiungi Telm al tuo gruppo Telegram e lascia che pensi lui allo spam.