惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Jina AI
Jina AI
C
Check Point Blog
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
T
Threatpost
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Know Your Adversary
Know Your Adversary
C
Cyber Attacks, Cyber Crime and Cyber Security
T
Tor Project blog
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Spread Privacy
Spread Privacy
Latest news
Latest news
Project Zero
Project Zero
T
Threat Research - Cisco Blogs
P
Palo Alto Networks Blog
雷峰网
雷峰网
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
N
News and Events Feed by Topic
P
Privacy International News Feed
Vercel News
Vercel News
T
The Exploit Database - CXSecurity.com
S
Secure Thoughts
Application and Cybersecurity Blog
Application and Cybersecurity Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
F
Full Disclosure
T
Tenable Blog
Last Week in AI
Last Week in AI
Y
Y Combinator Blog
SecWiki News
SecWiki News
C
CERT Recently Published Vulnerability Notes
Forbes - Security
Forbes - Security
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
S
Security Affairs
The GitHub Blog
The GitHub Blog
J
Java Code Geeks
Blog — PlanetScale
Blog — PlanetScale
N
Netflix TechBlog - Medium
O
OpenAI News
Google DeepMind News
Google DeepMind News
V
Vulnerabilities – Threatpost
Engineering at Meta
Engineering at Meta
Hacker News - Newest:
Hacker News - Newest: "LLM"
N
News and Events Feed by Topic
The Cloudflare Blog
Stack Overflow Blog
Stack Overflow Blog
Schneier on Security
Schneier on Security
W
WeLiveSecurity
Recorded Future
Recorded Future
C
CXSECURITY Database RSS Feed - CXSecurity.com
博客园 - 三生石上(FineUI控件)

Все публикации подряд на Хабре

Ловим музу за клавиатуру: как айтишнику стать автором Что умеет Midjourney в 2026? Мой немного грустный разбор этого шикарного инструмента Никто не любит писать тесты, но ИИ может исправить это IPv8 выглядит как мечта. Поэтому почти наверняка не взлетит Производители вернули в продажу материнки с DDR3. Что происходит? Управление агентом с телефона через Telegram теперь в KodaCode От координации к лидерству: как меняется роль руководителя разработки Я сделала родителям бизнес вместо пенсии: зарабатываем 70 тысяч, мама не даёт продать В три раза быстрее приемка товара и оптимизация трудозатрат на 73%: как «РСТ-Инвент» помог Gulliver Group ИИ-шечный мир победил? О влиянии искусственного интеллекта на игропром Кремль снижает давление на Телеграмм пока Европа строит интернет по паспорту Как CEO, CTO и CIO за 8 часов собрали ИИ-директора, который умеет держать позицию под давлением Как (не) потерять домен за выходные Вместо 8 разных VPS: как я организовал практику студентам на одном сервере Почему твой Open Source проект не замечают? R&D: искусство управления неопределенностью в разработке AI-дефляция: вакансий для разработчиков больше, а рост зарплат — худший за 15 лет Мы отдали управление роботами OpenClaw. Что из этого вышло Галактический ID: система идентификации для всех форм разумной жизни Шесть основ бизнес-анализа: начинаем с вопроса «Кто в игре?» Код-ревью, в котором дело не в коде Данные переехали. Команда — нет Системной подход к сдаче OSWE в 2025 Почему комната управления реактором покрашена в цвет морской пены 4 YAML-файла вместо PySpark: как аналитикам строить пайплайны без разработчиков LLM-агент для поиска свободных доменов: автоматизируем подбор Когда, зачем и как правильно начинать новую сессию в Claude Code? Как я заставил нейросеть писать макросы для FreeCAD Анатомия ИИ‑агента для подбора персонала. От тысячи резюме к топ‑10 за минуты Опыт разработчика как экономика внимания Автономность как точка невозврата: кто будет субъектом в цифровом будущем Обучение ИИ в «диких» условиях: как рутинные действия превращаются в датасеты Как измерить LLM для задач кибербеза: обзор открытых бенчмарков Где хранить код? Сравнение GitHub, GitLab и Bitbucket Математика объясняет, почему нормальное распределение встречается повсюду Почему ваш FinOps не работает: 12 тезисов от практиков Как подписать проектную документацию УКЭП с использованием бесплатных лицензий Pilot Адаптивное администрирование Sigla Vision Я грузил уран в бочки, а потом 20 лет строил ИТ в атомной отрасли Чем позвонить с Эвереста? История и обзор спутниковой связи. Часть 2 Как языковая модель помогает контролировать качество инструктажей по охране труда в металлургии Как не передать на desktop свой IP в РКН Анатомия SAP Privileges: как устроено управление правами в macOS MoneyDev: Сказка про три главных слова Обновлённый токенизатор видео K-VAE 2.0 от Сбера Как сделать диспетчеризацию дома на 1284 квартиры почти бесплатно Как мы разогнали железную дорогу Мы дали агентам рутину. Теперь надо решить — что делать с освободившимся временем Токсичный контент, промпт-хакинг и защита ИИ — всё о Guardrails для LLM Умный город начинается с точного взгляда: как «Фалькон Тех» меняет пространство к лучшему Навайбкодил приложение для анализа графов Почему Дюну так интересно читать? Упрощаем работу с рутиной или как стать Гендальфом Белым Деконструкция Go: CPU, RAM и что там происходит. Go Assembler база. Часть 1.1 Какие профессии исчезнут из-за ИИ, а какие появятся? И что с этим делать Как мы построили IT-отдел, где хочется расти: архитектурные встречи, прозрачные метрики и книжные подарки Rufler: Делаем из Claude Code автономный рой через один YAML-конфиг Sing-box и белый список приложений Как построить надёжный обмен сообщениями в микросервисах: лучшие практики для enterprise OpenAI строит MLM-пирамиду, а McKinsey и Accenture помогают ей в этом Дом, который не построил Фишер (Часть 2) «Сверхзвуковой математик» против «Вдумчивого логиста»: битва алгоритмов 3D-упаковки Мультимодальные модели – грубый и дорогой инструмент Разговоры ничего не стоят. Код тоже Проверки физических лиц: с кого начнет ФНС Топ-10 бесплатных нейросетей для создания видео в 2026 году Первые слои кода: как наши решения сегодня определяют архитектуру ИИ на десятилетия Разработка нового статического анализатора: PVS-Studio JavaScript Поиск уязвимостей ПО: базовый минимум или роскошный максимум Почему оценка персонала не работает как инструмент управления Как мы разработали ИИ-ассистента и сократили рутину продуктовой команды на 50% Как я ушел из найма, нажарил косточек и продал на маркетплейсах на 168 млн в год Когда 1С:ERP уже внедрена, а нормального производственного плана всё ещё нет Как я сделал Claude мультимодальным, подключив к нему Qwen Omni Как приглашение на вакансию мечты превращается в атаку Infrastructure as Code: философия и лучшие практики IaC Тестируем Yandex Code Assistant на задаче, в которой нужно хранить секреты nxs-universal-chart v3.0: новое поколение универсального Helm-чарта Callback Injection: Техника, которая отправила Microsoft Defender в глухой нокаут «Все идеи на стол»: митап как способ вывести проект из тупика Сегодня я узнал нечто новое о GPU благодаря багу в своей игре Как заставить LLM ̶ ̶г̶а̶л̶л̶ю̶ ̶ эволюционировать Карта событий как фундамент аналитики: практический кейс для E-commerce Что выбрать для AI: x86, ARM или RISC-V? Дайджест железа за март Роль соматических мутаций в развитии аутоиммунных заболеваний: путь к избирательной терапии Mythos от Anthropic — тревожный сигнал для всех, а не только для банков Guardrails для LLM на Java: как приручить промпт‑инъекции и токсичные ответы Green-VLA: как мы собрали VLA-модель для реального антропоморфного робота и не потеряли обобщение Финансовая гонка вооружений: почему умные люди добровольно в ней участвуют Эра ИИ-агентов наступила: выбираем лучшего цифрового сотрудника # Практический опыт внедрения WinCC Redundancy на производственном предприятии Сделал MVP за 3 дня, а потом неделю прикручивал оплату. Оно того стоило? Физика против Маска: почему Starship V3 может оказаться ещё одной катастрофой Нефть Венесуэлы: крупнейшие запасы в мире, но не крупнейшая нефтяная держава JPA 4. Переосмысление Hibernate Почему зеркальная фотокамера Nikon D5 десятилетней давности идеально подошла для миссии «Артемида-2» Проект «Уровень-Спутник» или как мы сделали платформу для гидрологов «Замедлиться, чтобы ускориться»: почему ИИ повышает цену ошибок в требованиях и архитектуре Как с нуля поднять трафик IT-компании на 1657% при бюджете 55 тыс. и выжить Pixel-perfect Downsampling — идеальная отрисовка 50 миллионов точек без потерь
Эффект «галлюцинаций»: когда ИИ врет уверенным голосом
Andrey_Biryu · 2026-05-01 · via Все публикации подряд на Хабре

Эффект «галлюцинаций»: когда ИИ врет уверенным голосом

Уровень сложностиПростой

Время на прочтение8 мин

Охват и читатели484

Обзор

Статья подготовлена в рамках курса «Машинное обучение для начинающих».

Недавно в «беседе» с умной колонкой я задал ей вопрос относительно исполнителя одной музыкальной композиции. Колонка уверенно ответила, однако, так как у меня были сомнения в правильности, я переспросил ее и на этот раз она назвала другое имя. Также, при работе с различными языковыми моделями мне приходилось неоднократно сталкиваться с ситуациями, когда, к примеру, нейросеть неверно указывала нормативные документы, статьи законов и так далее

И такие случаи не единичны. Это — галлюцинации больших языковых моделей и это главная проблема, мешающая внедрять ИИ в медицину, юриспруденцию, финансы и образование.

В этой статье мы разберем: что такое галлюцинации, почему они неизбежны, и главное — как с ними жить и работать.

Глюки… просто глюки

Галлюцинация (hallucination) — это ситуация, когда языковая модель генерирует информацию, которая либо не соответствует действительности, либо не содержится в ее обучающих данных, либо не следует из предоставленного контекста, но всегда подается с абсолютной уверенностью.

Модель не говорит: «Мне кажется...» или «Возможно, что...». Она утверждает: «Согласно статье 7.2.3...» или «Как показало исследование Smith et al. (2021)...» И эта уверенность — самая опасная часть галлюцинации, потому что пользователь, особенно неспециалист, склонен доверять.

Для начала давайте классифицируем галлюцинации. Начнем с фактических галлюцинаций. Это неверные даты, имена, числа (Москва основана в 1047 году“ на самом деле — 1147). Далее идут ссылочные — выдуманные источники, статьи, законы. В свою очередь логические галлюцинации представляют собой нарушение причинно‑следственных связей, например: Если нагреть лед, он станет тверже. Противоречие предоставленному контексту это тоже разновидность галлюцинаций, здесь пример: документ говорит «не более 100», модель пишет «до 150».

Иногда в своих галлюцинациях модель может проявлять завидное упорство, повторяя одну и ту же ошибку даже после исправления, например 2+2=5.

Как видно, вариантов галлюцинаций довольно много, однако результат всегда один — это ненадежная работа нейросети и, как следствие, потеря доверия к результатам ее работы.

Не баг, а фича

Самое важное, что нужно понять: галлюцинации — это не ошибка в коде. Это прямое следствие того, как работают языковые модели. Большая языковая модель (GPT, Claude, Llama) — это не база знаний, а это генератор правдоподобной последовательности токенов. Когда вы задаете вопрос, модель не «ищет ответ в памяти». Она делает статистический расчет:

«Учитывая предыдущие слова, какой следующий токен с наибольшей вероятностью продолжит этот текст так, как это было в обучающих данных?»

Модель не знает, что такое «правда». Она знает, что в обучающих данных после фразы «Столица Франции» с высокой вероятностью следует токен «Париж».

Но если в обучающих данных недостаточно примеров про какой‑то редкий факт — модель начнет «фантазировать», комбинируя паттерны из других контекстов.

Представьте джазового пианиста, которого научили играть, показав 10 000 часов записей концертов. Он никогда не видел нот, не знает теории. Но он отлично чувствует паттерны: после определенных аккордов обычно идут другие, есть типичные переходы, узнаваемые фразы.

Вы просите его сыграть конкретную песню. Если он ее «слышал» много раз — сыграет точно. Если слышал пару раз в похожей аранжировке — сыграет что‑то близкое. Если не слышал никогда — начнет импровизировать, выдавая то, что звучит правдоподобно, даже если это совсем другая мелодия.

По сути, LLM — такой же джазовый импровизатор. Только вместо нот — слова, вместо мелодий — факты.

Три главные причины галлюцинаций

1. Недостаток данных в обучающей выборке

Если модель видела факт 1000 раз — она его запомнила. Если 2–3 раза в разных вариациях — может перепутать. Если ни разу — будет выдумывать.

Пример: модель отлично знает, кто такой Ленин или Пушкин. Но спросите про малоизвестного регионального политика — получите фантазию.

2. Давление на генерацию (температура)

Модели имеют параметр «температура» — чем он выше, тем более креативные и разнообразные ответы. При высокой температуре модель чаще выбирает не самый вероятный токен, а второй или третий по вероятности. Это делает ответ интереснее, но и увеличивает риск галлюцинаций.

3. Конфликт между знанием и инструкцией

Иногда пользователь просит модель сделать то, что противоречит ее обучающим данным. Например: «Напиши, что 2+2=5». Модель может подчиниться инструкции или попытаться возразить. Результат непредсказуем.

Почему это нельзя «вылечить» дообучением

Самым простым способом решить проблему галлюцинаций кажется дообучение модели на дополнительных, правильных фактах. Но в реальности это работать не будет, потому что здесь проблема принципиальная, а не техническая.

Прежде всего, важно понимать, что объем знаний бесконечен. Мир генерирует примерно 2,5 квинтиллиона байт данных в день. Ни одна модель не может «выучить» всё. Всегда будут факты, которых модель не видела, и на неизвестное она будет галлюцинировать.

Помимо этого, знания постоянно меняются. Вчера президентом был один человек, сегодня уже другой. Модель, обученная на данных до 2022 года, будет уверенно называть старые факты. Это галлюцинация? Формально — да, информация устарела. Но модель не знает, что прошло время. С этим мы все часто сталкиваемся, когда просим нейросеть показать настройки для различных приложений. Очень часто то, что она предлагает, не совсем соответствует действительности именно потому, что данные, на которых она обучалась, успели устареть.

Для решения проблемы можно сделать модель очень «осторожной» — она будет отвечать только на самые простые вопросы, а на всё остальное — «я не знаю». Но такая модель бесполезна. Пользователи хотят, чтобы ИИ пытался отвечать, даже если не уверен. А попытки = риск галлюцинаций.

Таким образом, мы приходим к выводу, что галлюцинации нельзя устранить полностью. Можно только минимизировать и научиться с ними работать.

Как бороться с галлюцинациями: инженерные методы

Хотя полностью победить проблему нельзя, есть проверенные техники, которые радикально снижают частоту галлюцинаций.

Начнем с RAG (Retrieval‑Augmented Generation). Суть этой техники — не полагаться на «память» модели, а перед ответом дать ей актуальные документы.

Как все это работает: пользователь задает вопрос. Система ищет релевантные фрагменты в вашей базе знаний (википедия, внутренние документы, БД). Модель получает вопрос + найденные фрагменты + инструкцию «отвечай ТОЛЬКО на основе этих фрагментов». Модель генерирует ответ, не привлекая свои «знания».

Такой подход снижает галлюцинации на 70–90% для фактологических вопросов.

Пример (промпт для RAG):

Ответь на вопрос, используя ТОЛЬКО информацию из следующих документов.

Если ответа нет в документах — скажи «Информация не найдена».

Не добавляй факты из своего знания.

Еще один способ — это контроль температуры и top‑p. Его суть заключается в том, чтобы снизить креативность модели, заставив ее выбирать только самые вероятные токены.

Настройки для минимизации галлюцинаций:

temperature = 0.0 или 0.1 (почти детерминированные ответы)

top_p = 0.9 или ниже

Такой подход применим в юридических, медицинских, финансовых задачах, где точность критична.

При этом его не стоит использовать при решении творческих задач, генерации идей, написании текстов — там нужна креативность.

Цепочка мыслей с самопроверкой заставляет модель несколько раз подумать и сравнить ответы.

Шаблон:

Вопрос: [ВОПРОС]

1. Сначала подумай шаг за шагом, записывая рассуждения.

2. Напиши предварительный ответ.

3. Проверь каждый факт в ответе на соответствие логике и здравому смыслу.

4. Если нашел ошибку — исправь.

5. Дай финальный ответ.

📌 Важно: если ты не уверен на 100% — напиши «Я не уверен, но предположительно...»

Запрет на выдуманные источники

Здесь все просто, мы явно запрещаем модели создавать ссылки, цитаты, имена.

Пример:

НЕ выдумывай источники, статьи, имена авторов или даты.

Если тебе нужно сослаться на факт — напиши «Согласно моим обучающим данным...».

НЕ используй фразы «как показало исследование», «согласно статье», «по данным ученых» — это провоцирует галлюцинации.

Практические стратегии для разных сценариев

В зависимости от задачи, стратегия работы с галлюцинациями должна быть разной. Давайте рассмотрим несколько сценариев.

Сценарий 1: Юридические и медицинские консультации

Здесь риски слишком велики, и галлюцинация может стоить денег, свободы или здоровья.

Поэтому мы предлагаем использовать только RAG с проверенными источниками с обязательной верификацией каждого факта человеком. Внедрить правило: «Если не найдено в источниках — сказать „Нет информации“„.“»

Сценарий 2: Написание кода

При написании кода галлюцинации проявляются в виде несуществующих библиотек или функций, и рекомендуемой стратегией будет Few‑shot с примерами рабочего кода и запрет на выдуманные API («НЕ используй функции, если ты не уверен, что они существуют»).

Сценарий 3: Генерация контента (статьи, посты)

А вот в этом случае риск достаточно низкий для творческой части, но высокий для фактической.

В таком случае нам нужно разделить задачу на две части: модель пишет структуру и текст, человек проверяет факты. Можно также использовать две модели: одна генерирует, вторая проверяет на галлюцинации. Добавляем в промпт: «Если ты не уверен в факте — отметь это звездочкой (*)».

Сценарий 4: Чат‑боты поддержки

При использовании чат‑ботов в поддержке в случае галлюцинации мы рискуем дать неверную информацию о продукте или услуге. Здесь нужно использовать RAG на базе официальной документации и FAQ и ввести ограничение: бот не может отвечать на вопросы вне своей базы знаний, и необходима эскалация человеку при неуверенности.

Как распознать галлюцинацию (навык для пользователя)

Вы не можете контролировать модель, но можете научиться замечать признаки галлюцинации в ее ответах. Например, слишком конкретные числа должны насторожить: «Ровно 14 372 человека» — модель редко помнит точные цифры.

Выдуманные имена: «Исследование профессора Джона Смита из Гарварда» — это пример классической галлюцинации. Также мы можем встретить несуществующие ссылки, но это легко проверяется с помощью поисковиков.

Еще одна типичная галлюцинация — это противоречие здравому смыслу: «Солнце вращается вокруг Земли» — модель могла «заиграться».

Наконец, идеальная гладкость: реальные тексты имеют оговорки («вероятно», «часто», «иногда»), галлюцинации — нет.

Вот небольшой практический алгоритм проверки:

Задайте тот же вопрос дважды с разными формулировками. Если ответы различаются в фактах — минимум один галлюцинация. Попросите модель дать источники, и если они выдуманные — это галлюцинация. Проверьте ключевые факты через быстрый поиск (Google, Википедия, официальные источники). Используйте другую модель (GPT-4 vs Claude vs Llama) и сравните ответы.

Заключение

LLM — это мощные, но глубоко несовершенные инструменты. Они не «знают» — они «генерируют правдоподобно». И в этом их сила (креативность, эмпатия, связность) и их слабость (галлюцинации).

Принимая решение об использовании ИИ в вашей работе, честно ответьте себе на вопрос: «Какова цена ошибки?»

  • Если цена ошибки высока (юриспруденция, медицина, авиация, финансы) — используйте RAG, верификацию человеком, низкую температуру, никогда не доверяйте модели без проверки.

  • Если цена ошибки низка (генерация идей, черновики, развлечение) — наслаждайтесь креативностью и не бойтесь галлюцинаций. Иногда именно они приводят к самым интересным открытиям.

Галлюцинации ИИ — хороший повод не просто осторожнее пользоваться нейросетями, а разобраться, как модели обучаются, ошибаются и принимают решения. На курсе «Машинное обучение для начинающих» можно собрать базу по ML и перейти от ощущения «ИИ магически отвечает» к пониманию, что происходит под капотом.

👉 А если хотите сначала примериться к теме, посмотрите календарь бесплатных открытых уроков: это быстрый способ познакомиться с преподавателями-практиками, форматом обучения и задать вопросы. [Перейти в календарь открытых уроков]