Перейти до основного вмісту

Як працює виявлення спаму в Telm

Простими словами про те, як Telm зупиняє спам: кілька рівнів захисту, наша власна ML-модель, AI для складних випадків та елементи керування, що залишають контроль за вами.

12 хв читання
Коротко

Кожне повідомлення проходить через кілька рівнів захисту, один за одним: глобальну перевірку спамерів на вході, велику бібліотеку детекторів правил і шаблонів, пам'ять про повторний спам, нашу власну ML-модель і — лише для справді межових випадків — AI-класифікатор, що читає зміст. Жодне окреме слово не може когось заблокувати, кожна дія фіксується й оборотна, а кожне ваше рішення спам / не спам робить систему точнішою для вашої групи.

Сторінка «Антиспам»: кілька рівнів захисту в одному місці.

Хочете це налаштувати? Зробіть це просто у своєму акаунті Telm.

Відкрити в дашборді

1Один бот, багато рівнів

Telm не покладається на єдиний трюк. Уявіть це як охорону в аеропорту: повідомлення проходить через кілька контрольних пунктів, один за одним, і може бути пропущене або зупинене на будь-якому з них.

Саме така багаторівнева побудова робить захист водночас надійним і швидким. Очевидні випадки вирішуються одразу, і лише справді неоднозначні повідомлення розглядаються уважніше — ось чому навіть жвава група з десятків тисяч учасників модерується в реальному часі, без жодних відчутних затримок.

  • Глобальна перевірка спамерів — відомі порушники зупиняються на вході, перед їхнім першим повідомленням.
  • Детектори правил і шаблонів — велика бібліотека, що розпізнає спам-схеми з першого погляду.
  • Пам'ять про повторний спам — хвиля ідентичного або схожого спаму ловиться одразу.
  • Наша власна ML-модель — навчена на реальному спамі багатьма мовами, щоб ловити кампанії, яких вона ніколи не бачила.
  • AI-класифікатор — читає зміст, для рідкісного повідомлення, що є справді межовим.
  • Самонавчання — ваші рішення роблять кожен рівень чіткішим для вашої групи.

2Шлях одного повідомлення

Ось що відбувається, коли хтось пише у вашій групі. Повідомлення перевіряється рівень за рівнем, і більшість повідомлень пропускаються або ловляться задовго до кінця.

Адміністратори, власник групи та довірені учасники з білого списку ніколи не модеруються — їхні повідомлення повністю оминають ці перевірки, тому вам ніколи не доведеться хвилюватися, що бот зачепить вашу власну команду.

  • Перевірка на вході — відомий спамер зупиняється на дверях глобальною базою спамерів перед його першим повідомленням (див. Список блокування CAS та глобальну базу спаму).
  • Правила й шаблони — багато детекторів складають спам-оцінку. Жодне окреме слово нікого не блокує; рішення випливає із суми сигналів.
  • Пам'ять про повторний спам — якщо той самий або майже ідентичний текст щойно оцінювався у вашій групі, ця відповідь використовується повторно, тож потік копій обробляється за один раз.
  • Наша ML-модель — оцінює, наскільки спамним виглядає формулювання; впевнений спам і впевнено чистий текст вирішуються тут, а проміжне йде далі.
  • Рівень AI — мовна модель читає зміст усе ще неоднозначного повідомлення (див. AI-модерацію).
  • Зображення та аудіо — перцептивне хешування, розпізнавання тексту OCR, виявлення QR-кодів та транскрипція голосу повертають свій текст у ті самі перевірки.
  • Вердикт і дія — пропустити, видалити, заглушити, заблокувати або надіслати на перегляд адміністратору. Усе фіксується з причиною в журналі модерації.

3Що насправді робить кожен рівень

Корисно знати, яку саме роботу виконує кожен контрольний пункт, адже вони ловлять дуже різні види спаму. Разом вони перекривають сліпі зони одне одного.

  • Детектори правил і шаблонів — створені вручну детектори, що розпізнають спам-схеми, а не окремі слова: принади перейти в особисті, приховану рекламу, просування зовнішніх каналів, структурні хитрощі та обфускацію. Вони працюють з нормалізованим текстом, тож змішані алфавіти та вставлені символи їх не обманюють.
  • Пам'ять про повторний спам — розпізнає ідентичні та майже ідентичні повідомлення (замінений номер телефону, інший нік) і повторно використовує попередній вердикт, тож скоординовані потоки припиняються тієї ж миті, коли починаються.
  • Наша власна ML-модель — класифікатор машинного навчання, натренований на величезній колекції підтвердженого спаму та чистого мовлення багатьма мовами. Вона узагальнює до кампаній, яких ніколи не бачила, зокрема обфускованих і перекладених варіантів.
  • AI-класифікатор — мовна модель, зарезервована для справжньої сірої зони. Вона читає намір, тож може відрізнити справжнє запитання від замаскованої пропозиції.
  • Розуміння зображень та аудіо — OCR витягує текст із банерів і скріншотів, перцептивне хешування зіставляє відомі спам-зображення, QR-коди декодуються, а голосові й відеоповідомлення транскрибуються. Увесь цей відновлений текст знову проходить ті самі перевірки правилами, моделлю та AI.
Оскільки попередні рівні самостійно вирішують переважну більшість повідомлень, AI потрібен лише для справді межових випадків — потужний захист, що все одно відчувається миттєвим.

4Оцінки, пороги та дії

Замість грубого так/ні кожне повідомлення накопичує спам-оцінку з багатьох сигналів. Що вища оцінка, то суворіша дія — і одне невдале слово ніколи не може саме по собі дійти до блокування, оскільки внесок ключових слів обмежений значно нижче за пороги покарання.

Це вбудований запобіжник проти хибних блокувань: вердикт ніколи не виноситься лише за словами, а тільки за повною картиною. Суворість цих порогів ви контролюєте через рівні суворості модерації та пресети захисту.

  • Дуже висока оцінка — автоматичне видалення, а за явного порушення — заглушення або блокування.
  • Середня оцінка — надсилається адміністратору на перегляд, а не обробляється наосліп.
  • Низька оцінка, нічого підозрілого — повідомлення пропускається негайно.
  • Нові або недовірені учасники стикаються з дещо суворішими порогами, ніж давні довірені завсідники, тож довірені учасники майже ніколи не потрапляють під санкції.
  • Кожна дія оборотна й може бути оскаржена, а кожне рішення фіксує, який рівень його ухвалив і чому (див. розуміння рішень модерації).

5Що це ловить

Замість зіставлення стоп-слів рушій розпізнає спам-схеми за їхнім цілісним шаблоном, зокрема обфусковані, графічні та озвучені варіанти. Ось родини, які він створений зупиняти.

  • Принади перейти в особисті — запрошення продовжити в приватних повідомленнях, навіть коли сформульовані як звичайна репліка.
  • Прихована реклама та просування сторонніх каналів, зокрема пересилання з інших каналів (див. керування пересиланнями та каналами).
  • Скоординовані кампанії — той самий текст, що з'являється в багатьох групах або з кількох акаунтів усередині однієї групи за короткий проміжок.
  • Шахрайські та фішингові шаблони — фейкові розіграші, інвестиційні принади та видавання себе за адміністраторів (див. як працює виявлення шахрайства).
  • Спам у зображеннях — банери казино, QR-коди й текст, вбудований у картинки.
  • Спам у голосових і відеоповідомленнях — пропозиції та посилання, зачитані вголос, щоб оминути ботів, які працюють лише з текстом.
  • Обфускований текст — змішані алфавіти, вставлені символи та схожі за виглядом знаки.

6Як запобігають хибним блокуванням

Найбільший страх щодо будь-якого антиспам-бота — що він помилково видалить справжнього учасника. Telm побудований так, щоб це було водночас рідкісним і завжди виправним, адже кожне рішення прозоре й оборотне.

Кілька запобіжників діють одночасно, і всі вони ставлять людське судження вище за машину.

  • Обмеження оцінки — самі лише ключові слова ніколи не можуть дійти до блокування; для цього потрібна сукупна вага багатьох незалежних сигналів.
  • Адміністратори та довірені учасники ніколи не модеруються, і ви можете додати більше імен до свого списку білого списку й довіри.
  • Зона середньої впевненості надсилається на перегляд адміністратору замість автоматичного покарання.
  • Кожна дія фіксується з причиною й може бути оскаржена — схвалені апеляції очищають і схожі повідомлення (див. як працюють апеляції).
  • Опційна персональна ML-модель вивчає звичайне мовлення вашої спільноти й накладає вето на хибні тривоги, що йому не відповідають — вона може лише виправдовувати повідомлення, ніколи не карати.
Якщо ви колись побачите помилкове видалення, схваліть апеляцію або позначте його як хибне спрацювання в журналі модерації. Цей людський вердикт перекриває машину й навчає кожен рівень не повторювати помилку.

7Вона вчиться у вас

Система не застигла. Ваші рішення модерації та схвалені апеляції безперервно навчають її, тож із часом вона стає точнішою для вашої конкретної спільноти.

Кожен із цих циклів зворотного зв'язку стоїть нижче за людське судження — коли ви схвалюєте апеляцію або позначаєте хибне спрацювання, цей вердикт перекриває машину й очищає також схожі повідомлення.

  • Ваші виправлення й далі вдосконалюють ML-модель, тож виявлення загострюється для тих повідомлень, які ваша група справді бачить.
  • Позначення одного повідомлення як хибного спрацювання миттєво очищає схожі повідомлення довкола нього.
  • Нові детектори перевіряються на реальному трафіку, перш ніж їм дозволять діяти, і відкликаються, якщо починають давати збої.
  • Історія учасника регулює, скільки поблажливості він отримує: історія чистих повідомлень дає трохи свободи, а покарання її звужує.
  • Персональну ML-модель можна натренувати на вашому власному чаті, щоб виправдовувати хибні тривоги на звичну для вашої спільноти манеру спілкування.

8Залишаючись за кермом

Ви вирішуєте, наскільки суворим є бот. Два налаштування важать найбільше на старті, а все, що робить бот, видиме й регульоване.

Режим спостереження дає змогу спостерігати, що зробив би бот, без фактичного покарання будь-кого — найбезпечніший спосіб побудувати довіру, перш ніж вмикати реальне застосування заходів.

  • Режим спостереження — лише спостереження, без покарань, усе фіксується для перегляду.
  • Рівні суворості та пресети — оберіть готовий профіль або точно налаштуйте пороги під вашу спільноту.
  • Послаблені правила — вкажіть конкретні детектори, які не повинні нараховувати оцінку у вашій групі (критичні захисти послабити не можна).
  • Режим дозволу продажів і крипто-спільноти — пом'якшує спрацювання для спільнот, де розмови про торгівлю є нормою.
  • Перемикачі по кожній групі для CAS, глобальної бази спаму, AI-модерації, голосової модерації та персональної моделі.
Уперше з ботом? Залиште режим спостереження ввімкненим на кілька днів, перегляньте журнал рішень у панелі, а потім увімкніть застосування заходів, щойно почнете довіряти рішенням.

9Найкращі практики та поширені помилки

Кілька звичок дають вам максимум захисту з мінімумом хибних тривог. Більшість проблем, з якими стикаються нові адміністратори, зводяться до пропуску однієї з них.

  • Обов'язково починайте в режимі спостереження й читайте журнал кілька днів, перш ніж застосовувати заходи.
  • Обов'язково додавайте до білого списку власну команду й відомих партнерів, щоб їхні посилання ніколи не викликали питань.
  • Обов'язково одразу вмикайте глобальну перевірку спамерів — вона усуває атаки ще до того, як ви їх побачите.
  • Обов'язково реагуйте на апеляції та хибні спрацювання; кожне виправлення робить захист вашої групи чіткішим.
  • Не вимикайте цілі захисти, щоб виправити одну хибну тривогу — краще послабте одне залучене правило або додайте учасника до білого списку.
  • Не очікуйте, що абсолютно нові спамери будуть у якомусь зовнішньому списку; саме для цього й існують рівні правил, моделі та AI.
Чи була ця стаття корисною?

Готові захистити свою групу?

Додайте Telm до своєї групи в Telegram і дозвольте йому впоратися зі спамом.