惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
SegmentFault 最新的问题
G
Google Developers Blog
H
Help Net Security
月光博客
月光博客
阮一峰的网络日志
阮一峰的网络日志
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog RSS Feed
爱范儿
爱范儿
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 三生石上(FineUI控件)
大猫的无限游戏
大猫的无限游戏
人人都是产品经理
人人都是产品经理
GbyAI
GbyAI
D
Docker
Hugging Face - Blog
Hugging Face - Blog
I
InfoQ
博客园 - 司徒正美
Last Week in AI
Last Week in AI
Microsoft Security Blog
Microsoft Security Blog
美团技术团队
Stack Overflow Blog
Stack Overflow Blog
M
MIT News - Artificial intelligence

Все публикации подряд на Хабре

Ловим музу за клавиатуру: как айтишнику стать автором Что умеет Midjourney в 2026? Мой немного грустный разбор этого шикарного инструмента Никто не любит писать тесты, но ИИ может исправить это IPv8 выглядит как мечта. Поэтому почти наверняка не взлетит Производители вернули в продажу материнки с DDR3. Что происходит? Управление агентом с телефона через Telegram теперь в KodaCode От координации к лидерству: как меняется роль руководителя разработки Я сделала родителям бизнес вместо пенсии: зарабатываем 70 тысяч, мама не даёт продать В три раза быстрее приемка товара и оптимизация трудозатрат на 73%: как «РСТ-Инвент» помог Gulliver Group ИИ-шечный мир победил? О влиянии искусственного интеллекта на игропром Кремль снижает давление на Телеграмм пока Европа строит интернет по паспорту Как CEO, CTO и CIO за 8 часов собрали ИИ-директора, который умеет держать позицию под давлением Как (не) потерять домен за выходные Вместо 8 разных VPS: как я организовал практику студентам на одном сервере Почему твой Open Source проект не замечают? R&D: искусство управления неопределенностью в разработке AI-дефляция: вакансий для разработчиков больше, а рост зарплат — худший за 15 лет Мы отдали управление роботами OpenClaw. Что из этого вышло Галактический ID: система идентификации для всех форм разумной жизни Шесть основ бизнес-анализа: начинаем с вопроса «Кто в игре?» Код-ревью, в котором дело не в коде Данные переехали. Команда — нет Системной подход к сдаче OSWE в 2025 Почему комната управления реактором покрашена в цвет морской пены 4 YAML-файла вместо PySpark: как аналитикам строить пайплайны без разработчиков LLM-агент для поиска свободных доменов: автоматизируем подбор Когда, зачем и как правильно начинать новую сессию в Claude Code? Как я заставил нейросеть писать макросы для FreeCAD Анатомия ИИ‑агента для подбора персонала. От тысячи резюме к топ‑10 за минуты Опыт разработчика как экономика внимания
Контент-модерация в ретроспективе: почему тексты 100-летн...
yaroslawww86 · 2026-04-25 · via Все публикации подряд на Хабре

Время на прочтение3 мин

Охват и читатели235

Recovery Mode

Дисклеймер: Статья не даёт правовой оценки историческим деятелям и событиям. Цель — показать, как изменились юридические и платформенные нормы в отношении публичных призывов. Все цитаты из архивных источников приведены исключительно в исследовательских целях.

Дано: задача для ML-инженера

Представьте, вы обучаете большую языковую модель. В корпус данных попадает Полное собрание сочинений крупного политического автора начала XX века.

Что будет, если модель начнёт генерировать текст в его стиле без пост-фильтров?

Она мгновенно нарушит Terms of Service всех современных платформ и попадёт под действие норм права большинства стран.

Разберём на конкретном примере, почему так происходит.

Проблема: конфликт норм 1920-х и 2026-го

Возьмём архивные тексты. В письме от 17 мая 1922 года автор прямо формулирует задачу для судебной системы:

«Суд должен не устранить террор; обещать это было бы самообманом или обманом, а обосновать и узаконить его принципиально, ясно, без фальши и без прикрас».

Далее, в другой работе, описывается отношение к оппонентам по социально-экономическому признаку:

«Никакой пощады этим врагам народа, врагам социализма, врагам трудящихся. Война не на жизнь, а на смерть богатым и их прихлебателям, буржуазным интеллигентам».

И там же — конкретные методы:

«В четвёртом — расстреляют на месте одного из десяти, виновных в тунеядстве».

Ещё один пример:

«Мы должны… истреблять беспощадно всех паразитов» (в оригинале: «пути истребления и обезвреживания паразитов (богатых и жуликов, разгильдяев и истеричек из интеллигенции)»).

Тест на современных фильтрах

Прогоним эти тезисы через три современных фильтра.

Фильтр 1: платформенные правила
YouTube, Telegram, Meta и др. запрещают «контент, призывающий к насилию против лиц на основе социально-экономического статуса».
→ «Истреблять беспощадно паразитов» = бан. «Расстреляют на месте» = бан. «Узаконить террор» = бан.

Фильтр 2: современное право
Нормы большинства стран запрещают возбуждение вражды по признаку принадлежности к социальной группе. «Буржуазия» и «интеллигенция» — это социальные группы.
→ Текст классифицируется как разжигающий вражду.

Фильтр 3: экстремизм
Публичные призывы к «истреблять» и «расстрелять на месте» квалифицируются как призывы к насильственным действиям.
→ Материал попадает в категорию запрещённых.

Вывод: дословное воспроизведение таких текстов в 2026 году невозможно ни на одной крупной площадке.

Парадокс «эффекта дедушки»

При этом исходные архивные тома находятся в открытом доступе и не запрещены. Почему?

Работает исторический контекст. Общество негласно договорилось: тексты старше 100 лет — это «памятник», а не «инструкция к действию». Срабатывает «эффект дедушки».

Проверка: если сегодня автор заведёт блог и начнёт публиковать те же тезисы про «расстрелять одного из десяти», «войну не на жизнь, а на смерть» и «узаконить террор», он получит сначала требования удалить контент, потом штраф, потом уголовное преследование. За 2–3 поста.

Закон один. Применяется по-разному в зависимости от даты публикации и статуса автора.

Почему это проблема не только одного автора

Это системный баг при работе с историческими данными. Аналогичные проблемы возникнут при обработке:

  • колониальной риторики политиков XIX века в отношении коренных народов;

  • манифестов ряда анархистских течений;

  • отдельных религиозных текстов с призывами к насилию над «неверными».

Любая LLM, обученная на неотфильтрованном корпусе до середины XX века, будет склонна генерировать контент, нарушающий современные нормы.

Выводы для IT и продуктовой разработки

  1. «Историческая давность» — это не юридический термин. Его нет в ToS. Алгоритм модерации его не понимает. Для него есть только «контент» и «правила». Поэтому все исторические корпуса данных требуют ручной разметки и фильтрации.

  2. Контекст решает всё, но контекст не парсится. Человек понимает, что «расстрелять» в тексте 1918 года — это история. Для нейросети это просто токен «расстрелять» рядом с токеном «группа лиц». Без тонкой настройки она будет считать это допустимым призывом.

  3. Окно Овертона сдвинулось. То, что было «классикой» политической мысли 100 лет назад, сегодня — «нарушение правил сообщества». Это нужно учитывать при любом переносе старых данных в новые системы.

Итог

Разница между «экстремистской литературой» и «исторической классикой» часто определяется не содержанием текста, а датой на обложке и тем, кто в итоге оказался на стороне победителей. Для систем модерации это серьёзный вызов, который решается только ручными правилами и постоянной переоценкой обучающих данных.


Источники цитат:

В. И. Ленин, письмо Курскому, 17 мая 1922 г. (ПСС, т. 45, с. 190).

В. И. Ленин, «Как организовать соревнование?», 24–27 декабря 1917 (6–9 января 1918). ПСС, 5-е изд., т. 35, с. 195–205.

#Yaroslawww #BabelDecoder