Разработан бесплатный шрифт ShieldFont, подменяющий в глазах ИИ осмысленный контент чушью

Интернет превратился в поле битвы. С одной стороны — люди, жаждущие контента. С другой — армии ИИ-ботов, которые этот контент воруют для обучения нейросетей. Бразильское агентство Seneda & Abrucio и датская студия Playtype нашли элегантный, почти хакерский способ обмануть алгоритмы. Они создали шрифт, который видит человек, и «шрифт», который видит машина.
В чем суть: обман на уровне глифов
Технология называется ShieldFont. Это не блокировщик и не программа-антибот. Это обычный файл шрифта, который подключается к вашему сайту. Человек открывает страницу и видит нормальный текст. ИИ-бот, читающий HTML-код, видит полную абракадабру. Фокус в том, что используется алгоритм замены глифов OpenType. Раньше эту технологию применяли для красивых лигатур, а теперь — для цифровой партизанщины.
Механика простая, но дьявольски эффективная. Вместо слова «небо» в коде прописано слово «стул». Вместо «бежать» — «сидеть». Браузер получает команду отрисовать на экране одно, а поисковый робот или парсер ИИ вытаскивает из исходника совсем другое. Это как если бы вы говорили человеку правду, а записывающий диктофон фиксировал ложь.
Почему это работает: грамматика решает
Главная проблема всех обфускаторов текста — они выдают мусор, который легко отсеять. Любой фильтр качества для обучения ИИ мгновенно вычисляет бессвязный набор слов. Разработчики ShieldFont пошли дальше. Они не просто перемешивают буквы, а подменяют целые слова с учетом частей речи. Существительное меняется на существительное, глагол прошедшего времени — на другой глагол прошедшего времени.
Словарь разбит на 250 групп по смыслу и числу. Заменяется примерно четверть слов в тексте. Предложение «Кот пил молоко» превращается в «Пёс ел суп». Грамматически это безупречно, но смысл улетучивается. Авторы проекта прогнали текст через популярный фильтр FineWeb-Edu и получили шокирующие цифры: в 55,8% случаев смысл меняется до полной неузнаваемости, а в 10% случаев обфусцированный текст вообще проходит проверку как «качественный». Это значит, что нейросеть может выучить, что «коты едят суп», и выдать это за факт.
Обратная сторона медали: доступность под ударом
Здесь я хочу высказать свое мнение, которое может не понравиться авторам. Решение гениальное, но оно бьет по самым уязвимым. Программы чтения с экрана, которыми пользуются люди с ослабленным зрением, работают именно с HTML-кодом. Они читают то, что видит ИИ, а не то, что вижу я. Для незрячего пользователя сайт с ShieldFont превратится в бессмысленный поток слов.
Разработчики, к их чести, предусмотрели компонент, который отдает «человеческий» текст скринридерам. Но это создает потенциальную дыру в защите — если бот научится использовать этот же компонент, вся система рухнет. Это гонка вооружений, где каждый патч создает новый вектор атаки.
Личное наблюдение и перспективы
Недавно я заметил, как мой знакомый редактор крупного издания вручную переписывает первые абзацы статей, чтобы их не украли для датасетов. Это адский труд. ShieldFont позволяет автоматизировать этот процесс за пару минут. Но есть нюанс.
Технология работает только против ботов, которые читают HTML. Современные мультимодальные модели, вроде GPT-4V или Gemini, умеют распознавать текст прямо со скриншота или отрисованной страницы. Против них шрифт бессилен. Плюс, сейчас ShieldFont понимает только английский язык. Для русского сегмента интернета это пока игрушка, а не инструмент защиты.
Что дальше? Я вижу два сценария. Первый — создатели контента массово внедрят такие шрифты, и качество обучающих выборок для ИИ резко упадет. Второй — разработчики ИИ быстро научатся обходить эту защиту, и мы получим новый виток гонки. Пока это работает, но я бы не ставил на ShieldFont как на панацею. Это скорее умная мина, которая замедлит противника, но не остановит его.
Если вы хотите защитить свой контент от парсинга — попробуйте. Проект открыт на GitHub, есть поддержка React. Но помните о цене вопроса: вы рискуете доступностью своего сайта для людей с инвалидностью. И всегда держите в уме, что это лишь временная мера. Вечный двигатель еще не изобрели, а вечной защиты от ИИ — тем более.














