Spamerzy przeszli od tekstu do obrazów, bo boty na zwykłe słowa kluczowe ich nie widzą. Telm sprawdza każdy obraz na trzy sposoby naraz: haszowanie percepcyjne rozpoznaje znane banery spamowe nawet po zmianie rozmiaru lub kolorów, OCR odczytuje tekst wydrukowany wewnątrz obrazu, a dekoder QR wyciąga ukryte linki i numery telefonów. Tekst wydobyty z obrazu przechodzi przez te same reguły antyspamowe co zwykłe wiadomości, więc baner kasyna z kodem QR jest usuwany tak szybko jak reklama tekstowa.
Chcesz to skonfigurować? Zrób to bezpośrednio na swoim koncie Telm.
Otwórz w panelu1Dlaczego spam kryje się w obrazach
Klasyczny filtr słów kluczowych patrzy tylko na tekst wiadomości, więc spamerzy umieszczają swoją ofertę w obrazie: baner kasyna, zrzut ekranu inwestycji, kod QR prowadzący do oszukańczego kanału. Dla naiwnego bota wiadomość wygląda pusto i nieszkodliwie.
Telm traktuje obraz jako treść do odczytania, a nie nieprzejrzysty załącznik. Każde zdjęcie jest sprawdzane, gdy toczą się pozostałe kontrole, więc spam obrazkowy jest zatrzymywany na tym samym przebiegu co spam tekstowy.
2Jak Telm odczytuje tekst wewnątrz obrazu
OCR (optyczne rozpoznawanie znaków) zamienia litery wydrukowane na obrazie z powrotem w tekst. Telm odczytuje silnikiem Tesseract, dostrojonym do języków, którymi faktycznie posługuje się Twoja społeczność.
Gdy tekst zostanie wydobyty, nietypowo bogaty w tekst obraz jest traktowany jako prawdopodobna reklama, a odzyskane słowa są przepuszczane przez Twoje zwykłe reguły spamu. Jeśli te reguły pasują, obraz jest oceniany dokładnie jak wiadomość tekstowa, która powiedziałaby to samo.
- Wielojęzyczne odczytywanie od ręki — domyślnie angielski i rosyjski, plus niemiecki, francuski, hiszpański i CJK (chiński, japoński, koreański).
- Bogaty w tekst obraz (dużo wydrukowanych słów przy dobrej pewności) jest sam w sobie sygnałem spamu.
- Odzyskany tekst jest ponownie sprawdzany wobec pełnej biblioteki reguł, więc ukryte oferty wewnątrz banerów są łapane.
- Wyniki są pamiętane po odcisku obrazu, więc ten sam obraz nigdy nie jest przetwarzany dwa razy.
3Trzy kontrole na każdym obrazie
OCR to jedna z trzech kontroli, które działają razem na każdym obrazie. Wspólnie obejmują ponownie użyte banery, wydrukowany tekst i zakodowane linki.
- Haszowanie percepcyjne — rozpoznaje znany baner spamowy nawet po zmianie rozmiaru, przycięciu lub przekolorowaniu. Obraz oznaczony jako spam w jednej grupie jest rozpoznawany we wszystkich grupach.
- OCR — odczytuje tekst wydrukowany wewnątrz obrazu i przepuszcza go przez reguły spamu.
- Dekoder QR — wyciąga linki (w tym t.me, wa.me i telegram.me) oraz numery telefonów ukryte w kodzie QR i oznacza podejrzane cele.
4Kiedy wkracza wizja AI
Szybkie kontrole powyżej rozstrzygają większość obrazów samodzielnie. Dla prawdziwej szarej strefy — obrazu, który nie jest ani oczywistym znanym banerem, ani oczywiście czystym — Telm może eskalować do modelu wizji AI, który opisuje, co obraz faktycznie pokazuje.
To głębsze spojrzenie jest zarezerwowane dla tych granicznych przypadków, więc wkracza tylko wtedy, gdy szybsze sygnały są niejednoznaczne.
5Co kontrolujesz
Inteligentne wykrywanie obrazów nie wymaga konfiguracji — jest włączone, gdy tylko bot wymusza. Jeśli Twoja społeczność w ogóle nie powinna publikować obrazów, możesz też zastosować bezwzględną blokadę, która usuwa każdy obraz niezależnie od treści.
Te dwa podejścia są niezależne: inteligentne wykrywanie usuwa spamerskie obrazy, przepuszczając zwykłe zdjęcia; bezwzględny filtr usuwa wszystkie obrazy. Większość grup chce tylko inteligentnego wykrywania.
- Inteligentne wykrywanie (haszowanie + OCR + QR) — zachowuje prawdziwe zdjęcia, usuwa spam obrazkowy. Domyślnie włączone.
- Blokuj wszystkie obrazy — twardy filtr dla społeczności wyłącznie tekstowych. Zobacz filtry treści.