Gli spammer sono passati dal testo alle immagini perché i bot basati su semplici parole chiave ne sono ciechi. Telm controlla ogni immagine in tre modi contemporaneamente: un hash percettivo riconosce i banner di spam noti anche dopo ridimensionamento o ricolorazione, l’OCR legge il testo stampato all’interno dell’immagine e un decodificatore QR estrae link e numeri di telefono nascosti. Il testo estratto da un’immagine passa attraverso le stesse regole antispam dei messaggi normali, così un banner di casinò con un codice QR viene rimosso con la stessa rapidità di un annuncio testuale.
Vuoi configurarlo? Fallo direttamente nel tuo account Telm.
Apri nella dashboard1Perché lo spam si nasconde nelle immagini
Un classico filtro a parole chiave guarda solo al testo del messaggio, così gli spammer mettono la loro offerta in un’immagine: un banner di casinò, uno screenshot di investimento, un codice QR che porta a un canale truffa. A un bot ingenuo il messaggio sembra vuoto e innocuo.
Telm tratta un’immagine come contenuto da leggere, non come un allegato opaco. Ogni foto viene ispezionata mentre girano gli altri controlli, così lo spam nelle immagini viene fermato nello stesso passaggio dello spam testuale.
2Come Telm legge il testo all’interno di un’immagine
L’OCR (riconoscimento ottico dei caratteri) trasforma le lettere stampate su un’immagine di nuovo in testo. Telm legge con il motore Tesseract, ottimizzato per le lingue che la Sua community effettivamente parla.
Una volta estratto il testo, un’immagine insolitamente ricca di testo viene trattata come un probabile annuncio, e le parole recuperate vengono fatte passare attraverso le Sue normali regole antispam. Se quelle regole trovano corrispondenza, l’immagine riceve un punteggio proprio come un messaggio testuale che avesse detto la stessa cosa.
- Lettura multilingue pronta all’uso — inglese e russo per impostazione predefinita, più tedesco, francese, spagnolo e CJK (cinese, giapponese, coreano).
- Un’immagine ricca di testo (molte parole stampate con buona confidenza) è di per sé un segnale di spam.
- Il testo recuperato viene ricontrollato rispetto all’intera libreria di regole, così le offerte nascoste nei banner vengono catturate.
- I risultati vengono ricordati tramite l’impronta dell’immagine, così la stessa immagine non viene mai elaborata due volte.
3Tre controlli su ogni immagine
L’OCR è uno dei tre controlli che girano insieme su ciascuna immagine. Tra loro coprono i banner riutilizzati, il testo stampato e i link codificati.
- Hash percettivo — riconosce un banner di spam noto anche dopo che è stato ridimensionato, ritagliato o ricolorato. Un’immagine segnalata come spam in un gruppo viene riconosciuta in tutti i gruppi.
- OCR — legge il testo stampato all’interno dell’immagine e lo fa passare attraverso le regole antispam.
- Decodificatore QR — estrae link (compresi t.me, wa.me e telegram.me) e numeri di telefono nascosti in un codice QR, e segnala le destinazioni sospette.
4Quando entra in gioco la visione AI
I controlli rapidi qui sopra risolvono la maggior parte delle immagini da soli. Per la vera zona grigia — un’immagine che non è né un banner noto evidente né evidentemente pulita — Telm può passare a un modello di visione AI che descrive ciò che l’immagine mostra realmente.
Questo sguardo più profondo è riservato a quei casi limite, quindi entra in gioco solo quando i segnali più rapidi sono inconcludenti.
5Cosa controlla Lei
Il rilevamento intelligente delle immagini non richiede alcuna configurazione — è attivo non appena il bot applica la moderazione. Se la Sua community non dovrebbe pubblicare immagini affatto, può anche applicare un blocco netto che elimina ogni immagine a prescindere dal contenuto.
I due approcci sono indipendenti: il rilevamento intelligente rimuove le immagini spam lasciando passare le foto normali; il filtro netto rimuove tutte le immagini. La maggior parte dei gruppi vuole solo il rilevamento intelligente.
- Rilevamento intelligente (hash + OCR + QR) — mantiene le foto reali, rimuove lo spam nelle immagini. Attivo per impostazione predefinita.
- Blocca tutte le immagini — un filtro netto per le comunità solo-testo. Veda filtri dei contenuti.