Каждое сообщение проходит через несколько слоёв защиты один за другим: глобальная проверка на спамера у входа, большая библиотека правил и шаблонных детекторов, память на повторный спам, собственная ML-модель и — только для по-настоящему пограничных случаев — AI-классификатор, который читает смысл. Ни одно отдельное слово не может никого забанить, каждое действие фиксируется и обратимо, и каждое ваше решение спам / не спам делает систему точнее для вашей группы.
Хотите это настроить? Сделайте это прямо в своём аккаунте Telm.
Открыть в дашборде1Один бот, много слоёв
Telm не полагается на один приём. Представьте это как охрану в аэропорту: сообщение проходит через несколько контрольных пунктов один за другим и может быть пропущено или остановлено на любом из них.
Именно эта многослойная конструкция делает защиту одновременно надёжной и быстрой. Очевидные случаи решаются сразу, и лишь по-настоящему неоднозначные сообщения рассматриваются пристальнее — вот почему даже активная группа на десятки тысяч участников модерируется в реальном времени и никогда не тормозит.
- Глобальная проверка на спамера — известных нарушителей останавливают у входа, до их первого сообщения.
- Правила и шаблонные детекторы — большая библиотека, которая распознаёт спам-схемы с первого взгляда.
- Память на повторный спам — волна идентичного или похожего спама ловится сразу.
- Собственная ML-модель — обучена на реальном спаме на многих языках, чтобы ловить кампании, которых она никогда не видела.
- AI-классификатор — читает смысл, для редкого сообщения, которое по-настоящему пограничное.
- Самообучение — ваши решения делают каждый слой острее для вашей группы.
2Путь одного сообщения
Вот что происходит, когда кто-то публикует сообщение в вашей группе. Сообщение проверяется слой за слоем, и большинство сообщений пропускаются или ловятся задолго до конца.
Админов, владельца группы и доверенных участников из белого списка никогда не модерируют — их сообщения полностью пропускают эти проверки, поэтому вам никогда не нужно беспокоиться, что бот тронет вашу собственную команду.
- Проверка на входе — известного спамера останавливает у двери глобальная база спамеров до его первого сообщения (см. блок-лист CAS и глобальную базу спама).
- Правила и шаблоны — множество детекторов складывают спам-оценку. Ни одно отдельное слово никого не банит; решение приходит из суммы сигналов.
- Память на повторный спам — если тот же или почти идентичный текст только что оценивался в вашей группе, этот ответ переиспользуется, поэтому наплыв копий обрабатывается за один раз.
- Наша ML-модель — оценивает, насколько спамной выглядит формулировка; уверенный спам и уверенно чистый текст решаются здесь, а серёдка идёт дальше.
- AI-слой — языковая модель читает смысл всё ещё неоднозначного сообщения (см. AI-модерацию).
- Изображения и аудио — перцептивное хэширование, распознавание текста OCR, детект QR-кодов и транскрипция голоса возвращают свой текст в те же самые проверки.
- Вердикт и действие — пропустить, удалить, замьютить, забанить или отправить на проверку админу. Всё фиксируется с причиной в журнале модерации.
3Что на самом деле делает каждый слой
Полезно знать, какую работу на самом деле выполняет каждый контрольный пункт, потому что они ловят очень разные виды спама. Вместе они прикрывают слепые зоны друг друга.
- Правила и шаблонные детекторы — детекторы, собранные вручную, которые распознают спам-схемы, а не отдельные слова: наживки на переход в личку, скрытая реклама, продвижение внешних каналов, структурные уловки и обфускация. Они работают на нормализованном тексте, поэтому смешанные алфавиты и вставленные символы их не обманывают.
- Память на повторный спам — распознаёт идентичные и почти идентичные сообщения (подменённый номер телефона, другой ник) и переиспользует прежний вердикт, поэтому скоординированные наплывы гасятся в тот момент, когда начинаются.
- Собственная ML-модель — классификатор машинного обучения, обученный на огромной коллекции подтверждённого спама плюс чистой речи на многих языках. Он обобщает на кампании, которых никогда не видел, включая обфусцированные и переведённые варианты.
- AI-классификатор — языковая модель, зарезервированная для настоящей серой зоны. Он читает намерение, поэтому может отличить настоящий вопрос от замаскированной подачи.
- Понимание изображений и аудио — OCR вытаскивает текст из баннеров и скриншотов, перцептивное хэширование сопоставляет известные спам-картинки, QR-коды декодируются, а голосовые и видеосообщения транскрибируются. Весь этот восстановленный текст снова попадает в те же проверки правил, модели и ИИ.
4Оценки, пороги и действия
Вместо грубого «да/нет» каждое сообщение накапливает спам-оценку из многих сигналов. Чем выше оценка, тем сильнее действие — и одно неудачное слово никогда не может дотянуть до бана само, потому что вклад ключевых слов ограничен намного ниже порогов наказания.
Это встроенная защита от ложных банов: вердикт никогда не выносится одними словами, только по полной картине. Строгостью этих порогов вы управляете через уровни строгости модерации и пресеты защиты.
- Очень высокая оценка — автоматическое удаление, а для явного нарушения мьют или бан.
- Средняя оценка — отправляется админу на проверку, а не применяется вслепую.
- Низкая оценка, ничего подозрительного — сообщение освобождается немедленно.
- Новые или недоверенные участники сталкиваются с чуть более жёсткими порогами, чем давние доверенные завсегдатаи, поэтому доверенных участников почти никогда не ловят.
- Каждое действие обратимо и обжалуемо, и каждое решение фиксирует, какой слой решил и почему (см. понимание решений модерации).
5Что оно ловит
Вместо сопоставления стоп-слов движок распознаёт спам-схемы по всему их шаблону, включая обфусцированные, картиночные и озвученные варианты. Вот семейства, которые он создан останавливать.
- Наживки на переход в личку — приглашения продолжить в личных сообщениях, даже когда сформулированы как обычная реплика.
- Скрытая реклама и продвижение сторонних каналов, включая пересылки из других каналов (см. управление пересылками и каналами).
- Скоординированные кампании — один и тот же текст, всплывающий во многих группах или от нескольких аккаунтов внутри одной группы за короткое окно.
- Схемы скама и фишинга — фейковые розыгрыши, инвестиционные наживки и выдача себя за админов (см. как работает детект скама).
- Спам в изображениях — казино-баннеры, QR-коды и текст, запечённый в картинках.
- Спам в голосовых и видеосообщениях — подачи и ссылки, зачитанные вслух, чтобы обойти боты, работающие только с текстом.
- Обфусцированный текст — смешанные алфавиты, вставленные символы и похожие символы.
6Как предотвращаются ложные баны
Самый большой страх с любым антиспам-ботом — что он удалит реального участника по ошибке. Telm спроектирован так, чтобы это было и редким, и всегда исправимым, потому что каждое решение прозрачно и обратимо.
Несколько защитных механизмов работают одновременно, и все они ставят человеческое суждение выше машины.
- Ограничение оценки — одни ключевые слова никогда не могут дотянуть до бана; для этого нужен совокупный вес многих независимых сигналов.
- Админов и доверенных участников никогда не модерируют, и вы можете добавить больше имён в свой список белого списка и доверия.
- Зона средней уверенности уходит на проверку админу, а не под автоматическое наказание.
- Каждое действие фиксируется с причиной и может быть обжаловано — одобренные апелляции очищают и похожие сообщения (см. как работают апелляции).
- Опциональная персональная ML-модель изучает нормальную речь вашего сообщества и ветирует ложные тревоги, которые в неё не вписываются, — она может только очищать сообщения, но никогда не наказывать.
7Оно учится у вас
Система не заморожена. Ваши решения модерации и одобренные апелляции непрерывно её обучают, поэтому со временем она становится точнее для вашего конкретного сообщества.
Каждая из этих обратных связей находится ниже человеческого суждения — когда вы одобряете апелляцию или отмечаете ложное срабатывание, этот вердикт переопределяет машину и очищает также похожие сообщения.
- Ваши поправки продолжают улучшать ML-модель, поэтому детект обостряется под те сообщения, которые ваша группа реально видит.
- Отметка одного сообщения как ложного срабатывания мгновенно очищает похожие сообщения вокруг него.
- Новые детекторы проверяются на реальном трафике, прежде чем им позволят действовать, и отзываются, если они начинают ошибаться.
- Послужной список участника подстраивает, сколько послаблений он получает: история чистых сообщений зарабатывает немного свободы, наказание её ужесточает.
- Персональную ML-модель можно обучить на вашем собственном чате, чтобы очищать ложные тревоги на обычной манере общения вашего сообщества.
8Оставаться у руля
Вы решаете, насколько строг бот. Две настройки важнее всего, когда вы начинаете, и всё, что делает бот, видно и настраиваемо.
Режим наблюдения позволяет вам смотреть, что сделал бы бот, без того чтобы он кого-либо наказывал, — самый безопасный способ выстроить доверие перед включением реального применения.
- Режим наблюдения — только наблюдение, без наказаний, всё фиксируется для проверки.
- Уровни строгости и пресеты — выберите готовый профиль или тонко настройте пороги под ваше сообщество.
- Ослабленные правила — назовите конкретные детекторы, которые не должны давать оценку в вашей группе (критические виды защиты ослабить нельзя).
- Режим «разрешить продажи» и режим крипто-сообщества — смягчают срабатывания для сообществ, где разговоры о торговле нормальны.
- Переключатели для каждой группы для CAS, глобальной базы спама, AI-модерации, голосовой модерации и персональной модели.
9Лучшие практики и частые ошибки
Несколько привычек дают вам максимум защиты с минимумом ложных тревог. Большинство проблем, с которыми сталкиваются новые админы, сводятся к пропуску одной из них.
- Начинайте в режиме наблюдения и читайте журнал несколько дней перед применением.
- Добавляйте в белый список свою команду и известных партнёров, чтобы их ссылки никогда не подвергались сомнению.
- Включайте глобальную проверку на спамера сразу — она убирает атаки до того, как вы их вообще увидите.
- Реагируйте на апелляции и ложные срабатывания; каждая поправка делает защиту вашей группы острее.
- Не отключайте целые виды защиты, чтобы устранить одну ложную тревогу, — вместо этого ослабьте одно вовлечённое правило или добавьте участника в белый список.
- Не ждите, что совсем новые спамеры окажутся в каком-либо внешнем списке; именно для этого нужны слои правил, модели и ИИ.