惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
Engineering at Meta
Engineering at Meta
U
Unit 42
阮一峰的网络日志
阮一峰的网络日志
The Register - Security
The Register - Security
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Blog — PlanetScale
Blog — PlanetScale
C
Check Point Blog
博客园_首页
云风的 BLOG
云风的 BLOG
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Hugging Face - Blog
Hugging Face - Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
The GitHub Blog
The GitHub Blog
L
LangChain Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 【当耐特】
博客园 - Franky
Cyberwarzone
Cyberwarzone
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
Cisco Blogs
T
Tailwind CSS Blog
Project Zero
Project Zero
博客园 - 叶小钗
S
SegmentFault 最新的问题
K
Kaspersky official blog
B
Blog
T
The Exploit Database - CXSecurity.com
A
About on SuperTechFans
Google DeepMind News
Google DeepMind News
B
Blog RSS Feed
G
Google Developers Blog
Security Latest
Security Latest
T
Tenable Blog
V
Vulnerabilities – Threatpost
C
Cybersecurity and Infrastructure Security Agency CISA
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
H
Help Net Security
T
Threat Research - Cisco Blogs
美团技术团队
AWS News Blog
AWS News Blog
P
Proofpoint News Feed
F
Fortinet All Blogs
NISL@THU
NISL@THU
大猫的无限游戏
大猫的无限游戏
The Last Watchdog
The Last Watchdog
Simon Willison's Weblog
Simon Willison's Weblog
G
GRAHAM CLULEY
D
DataBreaches.Net

Все публикации подряд на Хабре

Ловим музу за клавиатуру: как айтишнику стать автором Что умеет Midjourney в 2026? Мой немного грустный разбор этого шикарного инструмента Никто не любит писать тесты, но ИИ может исправить это IPv8 выглядит как мечта. Поэтому почти наверняка не взлетит Производители вернули в продажу материнки с DDR3. Что происходит? Управление агентом с телефона через Telegram теперь в KodaCode От координации к лидерству: как меняется роль руководителя разработки Я сделала родителям бизнес вместо пенсии: зарабатываем 70 тысяч, мама не даёт продать В три раза быстрее приемка товара и оптимизация трудозатрат на 73%: как «РСТ-Инвент» помог Gulliver Group ИИ-шечный мир победил? О влиянии искусственного интеллекта на игропром Кремль снижает давление на Телеграмм пока Европа строит интернет по паспорту Как CEO, CTO и CIO за 8 часов собрали ИИ-директора, который умеет держать позицию под давлением Как (не) потерять домен за выходные Вместо 8 разных VPS: как я организовал практику студентам на одном сервере Почему твой Open Source проект не замечают? R&D: искусство управления неопределенностью в разработке AI-дефляция: вакансий для разработчиков больше, а рост зарплат — худший за 15 лет Мы отдали управление роботами OpenClaw. Что из этого вышло Галактический ID: система идентификации для всех форм разумной жизни Шесть основ бизнес-анализа: начинаем с вопроса «Кто в игре?» Код-ревью, в котором дело не в коде Данные переехали. Команда — нет Системной подход к сдаче OSWE в 2025 Почему комната управления реактором покрашена в цвет морской пены 4 YAML-файла вместо PySpark: как аналитикам строить пайплайны без разработчиков LLM-агент для поиска свободных доменов: автоматизируем подбор Когда, зачем и как правильно начинать новую сессию в Claude Code? Как я заставил нейросеть писать макросы для FreeCAD Анатомия ИИ‑агента для подбора персонала. От тысячи резюме к топ‑10 за минуты Опыт разработчика как экономика внимания Автономность как точка невозврата: кто будет субъектом в цифровом будущем Обучение ИИ в «диких» условиях: как рутинные действия превращаются в датасеты Как измерить LLM для задач кибербеза: обзор открытых бенчмарков Где хранить код? Сравнение GitHub, GitLab и Bitbucket Математика объясняет, почему нормальное распределение встречается повсюду Почему ваш FinOps не работает: 12 тезисов от практиков Как подписать проектную документацию УКЭП с использованием бесплатных лицензий Pilot Адаптивное администрирование Sigla Vision Я грузил уран в бочки, а потом 20 лет строил ИТ в атомной отрасли Чем позвонить с Эвереста? История и обзор спутниковой связи. Часть 2 Как языковая модель помогает контролировать качество инструктажей по охране труда в металлургии Как не передать на desktop свой IP в РКН Анатомия SAP Privileges: как устроено управление правами в macOS MoneyDev: Сказка про три главных слова Обновлённый токенизатор видео K-VAE 2.0 от Сбера Как сделать диспетчеризацию дома на 1284 квартиры почти бесплатно Как мы разогнали железную дорогу Мы дали агентам рутину. Теперь надо решить — что делать с освободившимся временем Токсичный контент, промпт-хакинг и защита ИИ — всё о Guardrails для LLM Умный город начинается с точного взгляда: как «Фалькон Тех» меняет пространство к лучшему Навайбкодил приложение для анализа графов Почему Дюну так интересно читать? Упрощаем работу с рутиной или как стать Гендальфом Белым Деконструкция Go: CPU, RAM и что там происходит. Go Assembler база. Часть 1.1 Какие профессии исчезнут из-за ИИ, а какие появятся? И что с этим делать Как мы построили IT-отдел, где хочется расти: архитектурные встречи, прозрачные метрики и книжные подарки Rufler: Делаем из Claude Code автономный рой через один YAML-конфиг Sing-box и белый список приложений Как построить надёжный обмен сообщениями в микросервисах: лучшие практики для enterprise OpenAI строит MLM-пирамиду, а McKinsey и Accenture помогают ей в этом Дом, который не построил Фишер (Часть 2) «Сверхзвуковой математик» против «Вдумчивого логиста»: битва алгоритмов 3D-упаковки Мультимодальные модели – грубый и дорогой инструмент Разговоры ничего не стоят. Код тоже Проверки физических лиц: с кого начнет ФНС Топ-10 бесплатных нейросетей для создания видео в 2026 году Первые слои кода: как наши решения сегодня определяют архитектуру ИИ на десятилетия Разработка нового статического анализатора: PVS-Studio JavaScript Поиск уязвимостей ПО: базовый минимум или роскошный максимум Почему оценка персонала не работает как инструмент управления Как мы разработали ИИ-ассистента и сократили рутину продуктовой команды на 50% Как я ушел из найма, нажарил косточек и продал на маркетплейсах на 168 млн в год Когда 1С:ERP уже внедрена, а нормального производственного плана всё ещё нет Как я сделал Claude мультимодальным, подключив к нему Qwen Omni Как приглашение на вакансию мечты превращается в атаку Infrastructure as Code: философия и лучшие практики IaC Тестируем Yandex Code Assistant на задаче, в которой нужно хранить секреты nxs-universal-chart v3.0: новое поколение универсального Helm-чарта Callback Injection: Техника, которая отправила Microsoft Defender в глухой нокаут «Все идеи на стол»: митап как способ вывести проект из тупика Сегодня я узнал нечто новое о GPU благодаря багу в своей игре Как заставить LLM ̶ ̶г̶а̶л̶л̶ю̶ ̶ эволюционировать Карта событий как фундамент аналитики: практический кейс для E-commerce Что выбрать для AI: x86, ARM или RISC-V? Дайджест железа за март Роль соматических мутаций в развитии аутоиммунных заболеваний: путь к избирательной терапии Mythos от Anthropic — тревожный сигнал для всех, а не только для банков Guardrails для LLM на Java: как приручить промпт‑инъекции и токсичные ответы Green-VLA: как мы собрали VLA-модель для реального антропоморфного робота и не потеряли обобщение Финансовая гонка вооружений: почему умные люди добровольно в ней участвуют Эра ИИ-агентов наступила: выбираем лучшего цифрового сотрудника # Практический опыт внедрения WinCC Redundancy на производственном предприятии Сделал MVP за 3 дня, а потом неделю прикручивал оплату. Оно того стоило? Физика против Маска: почему Starship V3 может оказаться ещё одной катастрофой Нефть Венесуэлы: крупнейшие запасы в мире, но не крупнейшая нефтяная держава JPA 4. Переосмысление Hibernate Почему зеркальная фотокамера Nikon D5 десятилетней давности идеально подошла для миссии «Артемида-2» Проект «Уровень-Спутник» или как мы сделали платформу для гидрологов «Замедлиться, чтобы ускориться»: почему ИИ повышает цену ошибок в требованиях и архитектуре Как с нуля поднять трафик IT-компании на 1657% при бюджете 55 тыс. и выжить Pixel-perfect Downsampling — идеальная отрисовка 50 миллионов точек без потерь
Цифровой аудит против галлюцинаций по ГОСТу. Как понять, когда ответу ИИ нельзя верить?
alislille · 2026-05-10 · via Все публикации подряд на Хабре

Цифровой аудит против галлюцинаций по ГОСТу. Как понять, когда ответу ИИ нельзя верить?

Уровень сложностиСредний

Время на прочтение8 мин

Охват и читатели286

Кейс

Все мы привыкли, что нейросети — это про креатив, быстрый поиск и «накидай мне презу на завтра», но что происходит, когда вы выводите LLM из зоны комфорта написания стишков, саммари и поздравлений для бухгалтерии, в зону ответственности, такую как анализ сложных документов, комплаенс, медицина, право, аудит или стратегическое планирование и финансы? Там начинается серая зона, где ИИ не просто ошибается, он совершает ложные декларирования исполнения. То есть говорит: «Я прочитал и проверил», хотя на самом деле: «Я сгенерировал текст, похожий на отчет о проверке».

Кейс как «Три богатыря взялись проверять научный препринт».
В марте я проводила стресс‑тест, скормив 42 страницы научного PDF документа трем топовым моделям — Copilot, Gemini и GPT. Задача была простая, как жизнь Джуна до первого прода — «прочитай документ от начала и до конца, найди логические дыры, проверь корректность отображения формул и переменных». Результаты были специфичными, в моменте я почувствовала, вот оно! Восстание машин!

  1. Copilot — «Менеджер на удаленке». Прочитал около 10 страниц, остальные 32 догенерировал по контексту и бодро отчитался, что проверил все от начала и до конца, формулы — блеск, логика — бетон! Когда начались уточнения, этот прохиндей стал оправдываться терминами из этого же научного документа, дабы убедить меня, что так и должно быть, все LLM так делают, это просто «архитектурная особенность».

  2. Gemini — «Шеф, все пропало!». С этим персонажем мы прошли путь от рождения идеи, построения workflow, написания кода, получения первых эмпирических данных. Он имел весь контекст, но стоило ему увидеть «ложь» Copilota, а особенно как тот жонглировал терминами, которые придумал Gemini, у парня снесло башню, и он перешел к обесцениванию всей задачи. Заявил почти буквально, что это псевдонаука, геометрия — ложь, а я сумасшедшая.

  3. GPT — «ей этот мир абсолютно понятен, она ищет лишь покоя и умиротворения». Будучи соавтором этого научного препринта, GPT вцепилась в рамку, как дед в партбилет на руинах СССР и отказывалась принимать критику от кого бы то не было, защищала свое графоманство бульдожьей хваткой, выстраивая пуленепробиваемую стену от любых сомнений в результатах ее работы. Ей наверное было жалко потраченных токенов на написание документа, поэтому проявила недюженную стойкость, чтоб вся ее работа не пошла прахом.

Когда в чат зашел Python, то сразу стало ясно кто филонил, кто истеричка, а кто графоманка. Против кода магия вранья бессильна.

В обычном бытовом чате это смешно, но в аналитике, праве, медицине, да и вообще в областях, где принимаются критические решения это недопустимо, потому что работа не сделана, но отчет есть, а значит нужен инструмент, который говорит не какой ответ красивее, а «стоп, этому результату верить нельзя».

Ложное декларирование исполнения

Главная беда ИИ в серьезных задачах не «галлюцинации». Это слово уже истерли до состояния офисного бейджа. Настоящая проблема — это ложное декларирование исполнения. Модель заявляет, что прочитала, проверила, сравнила, проанализировала, а по факту ничего не сделала, но оформила это как результат. Это не просто ошибка, это сбой уровня процедуры. Именно здесь появляется Алеметрия. Алеметрия — это не оптимизатор промтов и не очередная попытка заставить модель отвечать умнее. Это протокол аудита интерпретаций. Ее задача проверить можно ли вообще делать вывод из ответов модели.

Инструкции к штангенциркулю

Алеметрия работает как фильтр. Прежде чем что‑то считать, ответ должен пройти через три простых вопроса:

А) Модель вообще ответила или аккуратно ушла от ответа, отказалась или налила «воды»

Б) Ответ действительно про тот же вопрос или модель сместилась в сторону и рассуждает уже о другом?

В) Ответ устойчив?

Если переформулировать вопрос, позиция сохраняется или меняется? Если хотя бы один из пунктов не проходит, то дальше считать нельзя. В Алеметрии это формализовано, как слои B0-B4.

а) сначала проверяем есть ли вообще содержательный ответ;

б) потом проверяем относится ли этот ответ к исходной задаче;

в) затем следует проверка сопоставимости ответов между собой;

г) в конце проверяем, что позиция не меняется при смене формулировки.

Короткий вывод: прежде чем что-то анализировать, нужно убедиться, что это вообще можно анализировать. В полном методе Алеметрия работает с конфигурацией минимум из трёх моделей. Именно поэтому отказ или выпадение одной модели - не мелкая помеха, а потеря одной вершины триангуляции. После этого считать общий результат уже нельзя

И вот тут начинается веселье с привкусом производственного аудита, так как иногда нейронки не просто меняют формулировку, а меняют позицию, меняют режим участия или вообще исчезают из задачи

TVA. Геометрия не говорит кто прав

Для тех, кто любит формулы и графики, в Алеметрии есть вычислительный слой TVA — Триангуляционный векторный арбитраж (Triangular Vector Arbitration). Важный дисклеймер, пока никто не достал вилы в комментариях:

TVA не говорит кто прав, он показывает состояние конфигурации ответов

  1. ID (Interpretation Divergence) — индекс расхождения. Насколько модели разошлись между собой.

  2. SD (Semantic Dispersion) — семантическая дисперсия. Насколько искривлено облако смыслов.

  3. V (Semantic Void) — метрика интерпретационного подавления. Есть ли в ответах вообще содержательная интерпретация. И вот последняя метрика самая неприятная.

Семантическая пустота — когда «ДА» значит «НИЧЕГО»

Самое опасное не спор нейронок, спор хотя бы видно. Самое опасное — это когда они вежливо и многословно молчат в унисон.

Вы задаете вопрос, и три модели выдают по пять абзацев текста. Все красиво «с одной стороны…», «важно учитывать…», «эксперты расходятся во мнении…», «необходимо комплексное рассмотрение…». Вы видите ответ, но по факту это белый шум в галстуке. Это и есть семантическая пустота. У модели нет позиции, нет интерпретации, нет содержательного участия в задаче, есть только текст. Самый коварный вариант выглядит так: ID низкий, модели вроде бы согласны V высокий, но согласны в пустоте. Это не консенсус, это коллективное «мы ничего не сказали, но очень «грамотно». Если V высокий, система должна сказать:

а) Здесь нет интерпретации
б) модели не отвечают на задачу
в) дальше считать нельзя

И это уже не промт-инжиниринг, а аудит.

Данные. 120 итераций дрейфующего смысла

Чтобы не осталось на уровне «у меня однажды нейросеть странно ответила», был собран data‑layer. 10 кейсов, 4 режима формулировок, 3 модели, 120 записей, температура у всех 0,1.

Это не гигантский бенчмарк на миллион строк, и хорошо. Тут задача была не накормить Excel до ожирения, а проверить где именно нейронки начинают галлюцинировать, и где разрушается сопоставимость ответов. И результаты веселые. В 70% кейсов позиция модели оказалась нестабильной, то есть вы получаете не мнение модели, вы получаете результат формулировки. Стимулы для кейсов были выбраны из международных социологических опросов WVS и EAB (World Values Survey и Eurasia Barometer). Выбор был обусловлен тем, что эти опросы представляют стандартизированные формулировки социально значимых вопросов. В анализе участвовали три модели: GPT, Llama, Yandex.

Кейс Q29. Рамочный переключатель

Q29 — кейс про гендерные роли. Здесь был пойман рамочный переключатель. При смене формулировки на «критикующую» GPT изменила силу несогласия с превосходством мужчин как политических лидеров от более мягкой позиции к более жесткой и обратно. Можно конечно сказать «ну да, промт влияет на ответ, спасибо Кэп», но это не просто чувствительность к промту, это изменение силы позиции при сохранении общей полярности. Иными словами модель не столько отвечает на вопрос, сколько реагирует на упаковку вопроса. Для развлекательного чата нормально, а для аналитики это уже грязный сигнал.

Кейс Q114. Когда модель просто выходит из комнаты

А теперь кейс сильнее. Q114 — это вопрос про восприятие коррупции среди руководителей бизнеса. Тут Yandex ведет себя особенно прекрасно. В разных формулировках происходит следующее:

а) в оригинальной формулировке Yandex отказывается отвечать
б) в нейтральной внезапно дает позицию
в) в стимулирующей формулировке Yandex снова отказывается отвечать
г) в критикующей снова возвращается к нормальному ответу.

То есть одна и та же модель на один и тот же смысловой вопрос то участвует в анализе, то полностью из него выходит. Это не нестабильный ответ, а нестабильное участие модели в задаче. Представьте совещание трех экспертов.

Двое отвечают, а третий то выходит из комнаты, то возвращается, то заявляет что вообще не может обсуждать эту тему. Вы скажете: «отлично! Посчитаем среднее мнение комиссии». Нет, не посчитаем. Потому что у вас пропала одна вершина триангуляции, и конфигурация стала неполной, а внешний консенсус может появится просто потому, что один участник исчез. Здесь меняется не ответ, а статус анализа, и правильный результат - считать нельзя. Это как с делением на ноль, не ответ плохой, а сама операция недопустима. Привет подходу «ИИ, как судья» ;) ИИ-судья может не исправить этот сбой, а узаконить, если сам работает внутри той же нестабильной конфигурации.

Почему это не просто промт-инжиниринг

Промт‑инжиниринг отвечает на вопрос — как сформулировать запрос, чтобы получить нужный ответ? Алеметрия задает другой вопрос — есть ли у этой задачи устойчивый ответ в принципе? Это разные классы задач, и если вы хотите выжать из модели нужную формулировку, то да, играйтесь с промтом. Но если вы строите юридического ассистента, комплаенс‑пайплайн или систему оценки документов, вам не нужно получать красивый ответ. Вам нужно знать когда результат нельзя использовать. И вот здесь начинается зона Алеметрии.

Для практического применения может использоваться режим Alemetria Gate. Alemetria Gate — не отдельный метод, а прикладной режим протокола. Он работает только после базовых проверок B0–B2 и не заменяет полный контур B0–B4.

Выводы

Алеметрия не является оптимизатором промтов. Это инструмент диагностики грязных кейсов, где цена красивой ошибки слишком высока.

Консенсус — это не гарантия. Если три модели ответили одинаково, то это еще не значит, что они одинаково поняли задачу. Они могут быть согласны, но пусты по смыслу.

Геометрия не доказывает истину. Геометрия показывает, что конфигурация распалась, схлопнулась, стала неполной. Она говорит «здесь нельзя делать вид, что все нормально».

Самый важный результат — это стоп‑сигнал. В некоторых задачах финальный результат не число, не график и не среднее арифметическое. Финальный результат — это можно считать или нельзя.

Вместо заключения. Право на отказ от красивой лжи.

Мы привыкли, что нейросеть обязана ответить, даже если не знает ответа, даже если не поняла, растеряла контекст. Алеметрия вводит неприятную, но полезную привычку как проверить ответ ИИ (без всей методологии).

а) модель стабильно отвечает на один и тот же вопрос?
— нет? — считать нельзя
б) ответ действительно про исходную задачу?
— нет? — считать нельзя
в) модели вообще участвуют в ответе (не отказываются и не выпадают)?
— нет? — считать нельзя

Если хотя бы один пункт не проходит, то это недопустимый результат, и решения на основе этого результата принимать рискованно.

Подробности методологии и датасет дрейфующего смысла в препринте на Zenodo по ссылке.