Спамеры освоили ASCII-подмену символов — тот же трюк раньше использовали для обхода защиты ИИ
Спамеры начали активно использовать старый, но вновь ставший актуальным приём — ASCII-подмену символов. С его помощью злоумышленники маскируют запрещённые слова и ссылки, заменяя привычные символы на визуально похожие. Интересно, что похожая техника уже применялась для обхода защит современных систем искусственного интеллекта.
Как работает ASCII-подмена
Суть метода заключается в том, что отдельные символы в тексте заменяются на другие знаки, которые выглядят практически идентично для человека, но имеют другой код.
Например, вместо обычной латинской буквы злоумышленник может использовать похожий символ из расширенного набора Unicode. В результате человек видит привычное слово, тогда как система автоматической модерации может распознать совершенно другую последовательность символов.
На практике подобные методы позволяют создавать сообщения, которые визуально выглядят нормально, но при этом способны обходить фильтры, ориентированные на точное совпадение слов и фраз.
Особенно часто такой подход используется в рекламном спаме, фишинговых сообщениях и мошеннических рассылках.
Почему этот метод снова стал популярным
Развитие автоматической модерации привело к тому, что спамеры начали искать способы обмануть не только традиционные фильтры, но и системы на базе искусственного интеллекта.
ИИ-модели анализируют текст значительно глубже обычного поиска по ключевым словам, однако и они не всегда одинаково интерпретируют необычные Unicode-символы, смешение алфавитов и различные способы кодирования текста.
Поэтому злоумышленники экспериментируют с намеренно искажёнными сообщениями. Визуально они могут практически не отличаться от обычного текста, но для автоматической системы представляют собой другую строку.
Раньше таким способом пытались обходить защиту ИИ
Похожие методы получили известность благодаря исследованиям безопасности больших языковых моделей. Эксперты демонстрировали, что определённые варианты Unicode-подмены, необычного форматирования и манипуляций с текстом могут затруднять работу защитных механизмов.
В некоторых случаях речь шла о так называемых adversarial-атаках, когда входные данные специально формировались таким образом, чтобы модель неправильно интерпретировала их содержание.
Теперь аналогичные идеи всё чаще находят применение уже за пределами лабораторных экспериментов — в обычном спаме и мошеннических кампаниях.
Человек видит одно, фильтр — другое
Главная проблема заключается в разнице между визуальным восприятием и машинной обработкой текста.
Для пользователя две строки могут выглядеть одинаково:
«Бесплатный приз»
и
«Бесплатный прíз»
Однако технически это могут быть разные последовательности Unicode-символов.
Если фильтр недостаточно хорошо нормализует входные данные, подобные различия позволяют сообщению пройти автоматическую проверку.
Дополнительную сложность создаёт смешивание разных алфавитов. Например, отдельные символы кириллицы и латиницы внешне очень похожи, хотя компьютер воспринимает их как совершенно разные знаки.
Почему обычных спам-фильтров недостаточно
Современные системы защиты вынуждены учитывать не только само содержимое сообщения, но и способ его формирования.
Для эффективной борьбы с ASCII- и Unicode-подменой необходимо предварительно нормализовать текст, выявлять подозрительное смешение алфавитов, анализировать похожие символы и учитывать контекст сообщения.
Именно поэтому борьба со спамом постепенно превращается в гонку между автоматическими системами защиты и инструментами, которые пытаются их обмануть.
Старый трюк получил новую жизнь
Сам по себе приём с подменой символов далеко не новый. Однако распространение ИИ-моделей и автоматической модерации сделало его особенно интересным для злоумышленников.
То, что раньше использовалось преимущественно как экспериментальный способ обхода фильтров и ограничений ИИ, теперь может применяться в более привычных сценариях — от массовой рекламы до фишинга.
Для пользователей это означает, что подозрительное сообщение не стоит считать безопасным только потому, что оно успешно прошло автоматический фильтр. Визуально обычный текст вполне может содержать намеренно подменённые символы и вести на мошеннический ресурс.