Przejdź do treści głównej

Wykrywanie spamu obrazkowego OCR w Telm

Jak Telm odczytuje tekst wewnątrz obrazów, rozpoznaje znane banery spamowe i dekoduje kody QR, aby spam wyłącznie obrazkowy był łapany tak szybko jak zwykły tekst.

6 min czytania
W skrócie

Spamerzy przeszli od tekstu do obrazów, bo boty na zwykłe słowa kluczowe ich nie widzą. Telm sprawdza każdy obraz na trzy sposoby naraz: haszowanie percepcyjne rozpoznaje znane banery spamowe nawet po zmianie rozmiaru lub kolorów, OCR odczytuje tekst wydrukowany wewnątrz obrazu, a dekoder QR wyciąga ukryte linki i numery telefonów. Tekst wydobyty z obrazu przechodzi przez te same reguły antyspamowe co zwykłe wiadomości, więc baner kasyna z kodem QR jest usuwany tak szybko jak reklama tekstowa.

Obsługa obrazów znajduje się w Filtrach treści; tekst wewnątrz zdjęć jest odczytywany automatycznie.

Chcesz to skonfigurować? Zrób to bezpośrednio na swoim koncie Telm.

Otwórz w panelu

1Dlaczego spam kryje się w obrazach

Klasyczny filtr słów kluczowych patrzy tylko na tekst wiadomości, więc spamerzy umieszczają swoją ofertę w obrazie: baner kasyna, zrzut ekranu inwestycji, kod QR prowadzący do oszukańczego kanału. Dla naiwnego bota wiadomość wygląda pusto i nieszkodliwie.

Telm traktuje obraz jako treść do odczytania, a nie nieprzejrzysty załącznik. Każde zdjęcie jest sprawdzane, gdy toczą się pozostałe kontrole, więc spam obrazkowy jest zatrzymywany na tym samym przebiegu co spam tekstowy.

2Jak Telm odczytuje tekst wewnątrz obrazu

OCR (optyczne rozpoznawanie znaków) zamienia litery wydrukowane na obrazie z powrotem w tekst. Telm odczytuje silnikiem Tesseract, dostrojonym do języków, którymi faktycznie posługuje się Twoja społeczność.

Gdy tekst zostanie wydobyty, nietypowo bogaty w tekst obraz jest traktowany jako prawdopodobna reklama, a odzyskane słowa są przepuszczane przez Twoje zwykłe reguły spamu. Jeśli te reguły pasują, obraz jest oceniany dokładnie jak wiadomość tekstowa, która powiedziałaby to samo.

  • Wielojęzyczne odczytywanie od ręki — domyślnie angielski i rosyjski, plus niemiecki, francuski, hiszpański i CJK (chiński, japoński, koreański).
  • Bogaty w tekst obraz (dużo wydrukowanych słów przy dobrej pewności) jest sam w sobie sygnałem spamu.
  • Odzyskany tekst jest ponownie sprawdzany wobec pełnej biblioteki reguł, więc ukryte oferty wewnątrz banerów są łapane.
  • Wyniki są pamiętane po odcisku obrazu, więc ten sam obraz nigdy nie jest przetwarzany dwa razy.

3Trzy kontrole na każdym obrazie

OCR to jedna z trzech kontroli, które działają razem na każdym obrazie. Wspólnie obejmują ponownie użyte banery, wydrukowany tekst i zakodowane linki.

  • Haszowanie percepcyjne — rozpoznaje znany baner spamowy nawet po zmianie rozmiaru, przycięciu lub przekolorowaniu. Obraz oznaczony jako spam w jednej grupie jest rozpoznawany we wszystkich grupach.
  • OCR — odczytuje tekst wydrukowany wewnątrz obrazu i przepuszcza go przez reguły spamu.
  • Dekoder QR — wyciąga linki (w tym t.me, wa.me i telegram.me) oraz numery telefonów ukryte w kodzie QR i oznacza podejrzane cele.
Baza obrazów spamowych jest globalna: gdy baner zostanie oznaczony jako spam w dowolnej chronionej grupie, Telm zna go wszędzie. Zobacz jak działa wykrywanie spamu, aby poznać pełny potok.

4Kiedy wkracza wizja AI

Szybkie kontrole powyżej rozstrzygają większość obrazów samodzielnie. Dla prawdziwej szarej strefy — obrazu, który nie jest ani oczywistym znanym banerem, ani oczywiście czystym — Telm może eskalować do modelu wizji AI, który opisuje, co obraz faktycznie pokazuje.

To głębsze spojrzenie jest zarezerwowane dla tych granicznych przypadków, więc wkracza tylko wtedy, gdy szybsze sygnały są niejednoznaczne.

Haszowanie percepcyjne, OCR i dekodowanie QR działają w każdym planie jako część silnika podstawowego. Eskalacja do wizji AI jest częścią moderacji AI, dostępnej w Pro i Business.

5Co kontrolujesz

Inteligentne wykrywanie obrazów nie wymaga konfiguracji — jest włączone, gdy tylko bot wymusza. Jeśli Twoja społeczność w ogóle nie powinna publikować obrazów, możesz też zastosować bezwzględną blokadę, która usuwa każdy obraz niezależnie od treści.

Te dwa podejścia są niezależne: inteligentne wykrywanie usuwa spamerskie obrazy, przepuszczając zwykłe zdjęcia; bezwzględny filtr usuwa wszystkie obrazy. Większość grup chce tylko inteligentnego wykrywania.

  • Inteligentne wykrywanie (haszowanie + OCR + QR) — zachowuje prawdziwe zdjęcia, usuwa spam obrazkowy. Domyślnie włączone.
  • Blokuj wszystkie obrazy — twardy filtr dla społeczności wyłącznie tekstowych. Zobacz filtry treści.
Czy ten artykuł był pomocny?

Gotowy, aby chronić swoją grupę?

Dodaj Telm do swojej grupy na Telegramie i pozwól mu zająć się spamem.