惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

P
Proofpoint News Feed
J
Java Code Geeks
WordPress大学
WordPress大学
博客园 - 【当耐特】
博客园 - 叶小钗
小众软件
小众软件
博客园 - 聂微东
宝玉的分享
宝玉的分享
量子位
人人都是产品经理
人人都是产品经理
博客园_首页
罗磊的独立博客
腾讯CDC
美团技术团队
Google DeepMind News
Google DeepMind News
W
WeLiveSecurity
I
InfoQ
Engineering at Meta
Engineering at Meta
云风的 BLOG
云风的 BLOG
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
T
Threat Research - Cisco Blogs
Google DeepMind News
Google DeepMind News
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
H
Hacker News: Front Page
B
Blog RSS Feed
L
LangChain Blog
C
Check Point Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
G
GRAHAM CLULEY
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
Microsoft Azure Blog
Microsoft Azure Blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
博客园 - Franky
S
Schneier on Security
Attack and Defense Labs
Attack and Defense Labs
Microsoft Security Blog
Microsoft Security Blog
N
Netflix TechBlog - Medium
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
T
Tenable Blog
Simon Willison's Weblog
Simon Willison's Weblog
L
LINUX DO - 热门话题
阮一峰的网络日志
阮一峰的网络日志
Hacker News: Ask HN
Hacker News: Ask HN
A
Arctic Wolf
Schneier on Security
Schneier on Security
The Last Watchdog
The Last Watchdog
Latest news
Latest news
T
The Exploit Database - CXSecurity.com

Все публикации подряд на Хабре

Ловим музу за клавиатуру: как айтишнику стать автором Что умеет Midjourney в 2026? Мой немного грустный разбор этого шикарного инструмента Никто не любит писать тесты, но ИИ может исправить это IPv8 выглядит как мечта. Поэтому почти наверняка не взлетит Производители вернули в продажу материнки с DDR3. Что происходит? Управление агентом с телефона через Telegram теперь в KodaCode От координации к лидерству: как меняется роль руководителя разработки Я сделала родителям бизнес вместо пенсии: зарабатываем 70 тысяч, мама не даёт продать В три раза быстрее приемка товара и оптимизация трудозатрат на 73%: как «РСТ-Инвент» помог Gulliver Group ИИ-шечный мир победил? О влиянии искусственного интеллекта на игропром Кремль снижает давление на Телеграмм пока Европа строит интернет по паспорту Как CEO, CTO и CIO за 8 часов собрали ИИ-директора, который умеет держать позицию под давлением Как (не) потерять домен за выходные Вместо 8 разных VPS: как я организовал практику студентам на одном сервере Почему твой Open Source проект не замечают? R&D: искусство управления неопределенностью в разработке AI-дефляция: вакансий для разработчиков больше, а рост зарплат — худший за 15 лет Мы отдали управление роботами OpenClaw. Что из этого вышло Галактический ID: система идентификации для всех форм разумной жизни Шесть основ бизнес-анализа: начинаем с вопроса «Кто в игре?» Код-ревью, в котором дело не в коде Данные переехали. Команда — нет Системной подход к сдаче OSWE в 2025 Почему комната управления реактором покрашена в цвет морской пены 4 YAML-файла вместо PySpark: как аналитикам строить пайплайны без разработчиков LLM-агент для поиска свободных доменов: автоматизируем подбор Когда, зачем и как правильно начинать новую сессию в Claude Code? Как я заставил нейросеть писать макросы для FreeCAD Анатомия ИИ‑агента для подбора персонала. От тысячи резюме к топ‑10 за минуты Опыт разработчика как экономика внимания Автономность как точка невозврата: кто будет субъектом в цифровом будущем Обучение ИИ в «диких» условиях: как рутинные действия превращаются в датасеты Как измерить LLM для задач кибербеза: обзор открытых бенчмарков Где хранить код? Сравнение GitHub, GitLab и Bitbucket Математика объясняет, почему нормальное распределение встречается повсюду Почему ваш FinOps не работает: 12 тезисов от практиков Как подписать проектную документацию УКЭП с использованием бесплатных лицензий Pilot Адаптивное администрирование Sigla Vision Я грузил уран в бочки, а потом 20 лет строил ИТ в атомной отрасли Чем позвонить с Эвереста? История и обзор спутниковой связи. Часть 2 Как языковая модель помогает контролировать качество инструктажей по охране труда в металлургии Как не передать на desktop свой IP в РКН Анатомия SAP Privileges: как устроено управление правами в macOS MoneyDev: Сказка про три главных слова Обновлённый токенизатор видео K-VAE 2.0 от Сбера Как сделать диспетчеризацию дома на 1284 квартиры почти бесплатно Как мы разогнали железную дорогу Мы дали агентам рутину. Теперь надо решить — что делать с освободившимся временем Токсичный контент, промпт-хакинг и защита ИИ — всё о Guardrails для LLM Умный город начинается с точного взгляда: как «Фалькон Тех» меняет пространство к лучшему Навайбкодил приложение для анализа графов Почему Дюну так интересно читать? Упрощаем работу с рутиной или как стать Гендальфом Белым Деконструкция Go: CPU, RAM и что там происходит. Go Assembler база. Часть 1.1 Какие профессии исчезнут из-за ИИ, а какие появятся? И что с этим делать Как мы построили IT-отдел, где хочется расти: архитектурные встречи, прозрачные метрики и книжные подарки Rufler: Делаем из Claude Code автономный рой через один YAML-конфиг Sing-box и белый список приложений Как построить надёжный обмен сообщениями в микросервисах: лучшие практики для enterprise OpenAI строит MLM-пирамиду, а McKinsey и Accenture помогают ей в этом Дом, который не построил Фишер (Часть 2) «Сверхзвуковой математик» против «Вдумчивого логиста»: битва алгоритмов 3D-упаковки Мультимодальные модели – грубый и дорогой инструмент Разговоры ничего не стоят. Код тоже Проверки физических лиц: с кого начнет ФНС Топ-10 бесплатных нейросетей для создания видео в 2026 году Первые слои кода: как наши решения сегодня определяют архитектуру ИИ на десятилетия Разработка нового статического анализатора: PVS-Studio JavaScript Поиск уязвимостей ПО: базовый минимум или роскошный максимум Почему оценка персонала не работает как инструмент управления Как мы разработали ИИ-ассистента и сократили рутину продуктовой команды на 50% Как я ушел из найма, нажарил косточек и продал на маркетплейсах на 168 млн в год Когда 1С:ERP уже внедрена, а нормального производственного плана всё ещё нет Как я сделал Claude мультимодальным, подключив к нему Qwen Omni Как приглашение на вакансию мечты превращается в атаку Infrastructure as Code: философия и лучшие практики IaC Тестируем Yandex Code Assistant на задаче, в которой нужно хранить секреты nxs-universal-chart v3.0: новое поколение универсального Helm-чарта Callback Injection: Техника, которая отправила Microsoft Defender в глухой нокаут «Все идеи на стол»: митап как способ вывести проект из тупика Сегодня я узнал нечто новое о GPU благодаря багу в своей игре Как заставить LLM ̶ ̶г̶а̶л̶л̶ю̶ ̶ эволюционировать Карта событий как фундамент аналитики: практический кейс для E-commerce Что выбрать для AI: x86, ARM или RISC-V? Дайджест железа за март Роль соматических мутаций в развитии аутоиммунных заболеваний: путь к избирательной терапии Mythos от Anthropic — тревожный сигнал для всех, а не только для банков Guardrails для LLM на Java: как приручить промпт‑инъекции и токсичные ответы Green-VLA: как мы собрали VLA-модель для реального антропоморфного робота и не потеряли обобщение Финансовая гонка вооружений: почему умные люди добровольно в ней участвуют Эра ИИ-агентов наступила: выбираем лучшего цифрового сотрудника # Практический опыт внедрения WinCC Redundancy на производственном предприятии Сделал MVP за 3 дня, а потом неделю прикручивал оплату. Оно того стоило? Физика против Маска: почему Starship V3 может оказаться ещё одной катастрофой Нефть Венесуэлы: крупнейшие запасы в мире, но не крупнейшая нефтяная держава JPA 4. Переосмысление Hibernate Почему зеркальная фотокамера Nikon D5 десятилетней давности идеально подошла для миссии «Артемида-2» Проект «Уровень-Спутник» или как мы сделали платформу для гидрологов «Замедлиться, чтобы ускориться»: почему ИИ повышает цену ошибок в требованиях и архитектуре Как с нуля поднять трафик IT-компании на 1657% при бюджете 55 тыс. и выжить Pixel-perfect Downsampling — идеальная отрисовка 50 миллионов точек без потерь
Корпоративная память против галлюцинаций: как RAG возвращает бизнесу здравый смысл
Vitaliy_Ches · 2026-05-08 · via Все публикации подряд на Хабре

Уровень сложностиСредний

Время на прочтение7 мин

Охват и читатели1.3K

Обзор

В какой‑то момент почти у каждой компании появляется ощущение, что она захлебнулась в собственных данных. Переезд в «корпоративное облако», внедрение модных DMS и BI‑систем, аккуратные регламенты по наименованию файлов — кажется, вот‑вот наступит порядок, но в реальности растёт только число папок «архив», «старое» и документов «на согласовании_новое_финалющвс.docx». Сотрудники по‑прежнему тратят часы на поиск «того самого» пункта договора или локального акта, руководители получают взаимоисключающие ответы из разных отделов, а попытка собрать целостную картину по клиенту или проекту ведёт к лавинообразному росту копипаста в чате.

На этом фоне в офисы пришли большие языковые модели: ИИ внезапно научился писать тексты, извлекать полезное из документов и разговаривать «по‑человечески». 

Первые пилоты выглядели впечатляюще — чат‑бот уверенно отвечал на сложные вопросы, формировал справки и даже «подсказывал» основы ТК или налогового кодекса. Но очень быстро выяснилось, что у такого ассистента есть и тёмная сторона. Он галлюцинирует, уверенно выдумывает несуществующие пункты регламентов и придумывает условия договоров, которых никогда не было, подставляя бизнес под риски. Переучивать огромную модель под каждую компанию — дорого и долго, а полагаться на универсальные знания — опасно.

Именно в этой точке свершается RAG‑революция: подход «Генерация с дополненной выборкой» или Retrieval‑Augmented Generation превращает языковую модель в дисциплинированного «аналитика», который сначала обращается к вашей базе знаний, а уже потом отвечает, жёстко опираясь на реальные документы. 

В сочетании с крупными LLM такой подход меняет саму логику работы с корпоративной информацией: вместо «поиска по папкам» и бесконечных уточнений в чатах люди просто задают вопрос — а ИИ возвращает не фантазии, а проверенный ответ со ссылками на источники.

Мы уже поднимали эту тему в статье TEAMLY AI: как внедрить умный поиск по корпоративной базе знаний без утечек и галлюцинаций. В ней хорошо показано, как RAG‑модель берёт на себя роль мостика между разрозненными статьями, договорами и сканами и привычным диалогом с ассистентом. 

Суть RAG и почему он стал популярным

Генерация с дополненной выборкой (Retrieval‑Augmented Generation, RAG) — это архитектура, в которой генерация текста совмещена с поиском по вашим данным. Вместо того чтобы опираться на абстрактные «знания из интернета», модель сначала ищет релевантные фрагменты в корпоративном хранилище, а затем формулирует ответ, учитывая только эти данные.

Типичный цикл работы RAG выглядит так.

  • Пользователь формулирует запрос на обычном языке.

  • Система преобразует запрос в вектор и выполняет поиск по базе знаний (эмбеддинги документов, писем, карточек CRM и др.).

  • Извлечённые фрагменты добавляются в промпт LLM как контекст.

  • LLM генерирует ответ, опираясь на контекст и возвращая ссылки и цитаты из найденных документов.

Такой подход стал популярным по нескольким причинам.

  • Существенно снижает галлюцинации: модель не «вспоминает» мир в целом, а «читает» ваши документы.

  • Данные всегда актуальны: обновили регламент или договор — RAG‑система индексирует его, и ассистент сразу начинает использовать новую версию.

  • Возникает прозрачность: можно увидеть, из каких именно источников «собран» ответ, вплоть до конкретного пункта и версии документа.

  • Экономика: не нужно обучать собственную большую модель, достаточно использовать готовые LLM в связке с RAG‑слоем поверх корпоративных данных.

Связка RAG и LLM: библиотекарь и генератор

Если использовать метафору, LLM — это «говорящий аналитик», а RAG — «строгий библиотекарь».

  • LLM умеет формулировать сложные мысли простым языком, структурировать ответы, подбирать примеры и адаптировать стиль под пользователя.

  • RAG знает, где лежат факты: договора, регламенты, внутренние инструкции, презентации, карточки CRM, сканы и их распознавание.

Без RAG языковая модель не видит ваши рабочие документы — только то, что было в её обучающем датасете. В связке с RAG она превращается в корпоративного консультанта: «библиотекарь» извлекает нужные фрагменты, «аналитик» объясняет их человеческим языком и собирает единый ответ.

Пример 1. Запрос: «На каком основании уволен сотрудник X?»

  1. RAG ищет соответствующий приказ об увольнении, выдержки из трудового законодательства, локальные положения компании.

  2. LLM формулирует ответ, ссылаясь на конкретные пункты приказа и статей ТК, показывая ссылки на оригинальные документы.

Пример 2. Запрос: «Какие обязательства мы взяли на себя перед клиентом Y по контракту Z?»

  1. RAG находит текст договора, допсоглашения, протоколы разногласий и переписку.

  2. LLM собирает краткое резюме обязательств, выделяет SLA, штрафные санкции и особые условия, добавляя ссылки на соответствующие разделы.

Для каких задач бизнеса RAG подходит идеально

RAG‑архитектура особенно сильна там, где требуется точный ответ на основе корпоративных данных, а не «авторитетное мнение нейросети».

  • Поддержка клиентов. Чат‑бот отвечает по базе знаний, статьям, инструкциям и видео, сразу отдавая ссылки на подробные материалы или формы заявок. В результате растут показатели поддержки, доля самообслуживания увеличивается.

  • HR и внутренняя помощь. Когда сотрудники задают вопросы про отпуска, льготы, оформление перевода или удалённой работы, система отвечает им, опираясь на актуальные кадровые документы и приказы.

  • Юридический комплаенс. Юристы и менеджеры ищут условия договоров, оговорки, штрафы, внутренние политики и выдержки из нормативных актов.

  • Работы на внутренней инфраструктуре и внешняя техподдержка. Специалисты находят решения по мануалам, схемам, известным багам, спискам изменений, инструкциям по эксплуатации и спецификациям оборудования.

  • Аналитика продаж. Руководители и аккаунт‑менеджеры могут попросить тренды по CRM, истории сделок, кейсы, сформировать сводку по клиенту за один запрос.

  • Ввод в должность (онбординг) сотрудников. Новички спрашивают, как устроены процессы, какие есть роли, доступы и регламенты — система выдаёт ответы со ссылками на инструкции во внутренней базе знаний.

«Рабочий профиль» RAG‑сценариев

Область

Типичные запросы

Роль RAG‑модели

Поддержка клиентов

«Как подключить тариф X?», «Что ответить клиенту Y?»

Находит инструкции и макеты ответов, выдаёт ссылки на статьи.

HR и внутренняя

«Как оформить отпуск?», «Какие льготы у нас есть?»

Поиск по кадровым регламентам, политикам и формам.

Юридический блок

«Что прописано в пункте 7.3 договора?»

Извлекает условия, штрафы, SLA, показывает контекст.

IT‑поддержка

«Почему не открывается VPN?», «Как перезапустить сервис?»

Ищет по документации, базе инцидентов и чек‑листам.

Продажи

«Что обещали клиенту Z?», «Какая история сделок по Y?»

Собирает данные из CRM, почты, КП и договоров.

Ввод в должность (онбординг)

«С чего начать новому менеджеру?»

Даёт ссылки на курсы, вики и регламенты, строит дорожную карту.

Для каких задач RAG не годится

При всех плюсах RAG не решает всё подряд, и важно понимать его границы.

  • Многомодальный анализ без текста. Сложные графики, схемы, видео без расшифровок и чертежи остаются «слепой зоной», если их содержимое не описано в текстовом виде.

  • Точные вычисления. Расчёт налогов, бухгалтерские проводки, сложные финансовые модели лучше отдавать специализированным системам, а RAG использовать для поиска методик и регламентов.

  • Глубокий аналитический вывод. Стратегическое планирование, прогнозирование с десятком факторов — это зона, где ИИ может подготовить фактуру, но не заменить живую экспертизу.

  • Отсутствующие данные. Если документ не загружен в базу, RAG его не найдёт, а LLM рискует начать выдумывать ответ, особенно при слишком общем запросе.

  • Высокорисковые решения. Сложные медицинские, юридические или финансовые решения не должны приниматься «по подсказке ИИ» без проверки экспертами.

  • Жёсткие правила и сотни веток логики. Задачи вида «если А и B, но не C, тогда…» на сотни страниц проще реализовать через движки бизнес‑правил и экспертные системы.

Это база. 

Пользовательский сценарий: RAG в TEAMLY

TEAMLY — база знаний + обучение + ИИ, в которой ИИ‑ассистент изначально строился как гибрид LLM и RAG. 

С точки зрения пользователя всё выглядит просто.

  • Он задаёт вопрос: «Расскажи, как у нас оформляется перевод сотрудника между отделами» или «Что делать, если клиент просит изменить сроки поставки?».

  • TEAMLY AI на основе RAG‑модели ищет по корпоративной базе: статьи вики, регламенты, формы заявлений, шаблоны писем, записи стратегических сессий и даже распознанные сканы договоров.

  • На выходе ассистент выдаёт структурированный ответ: пошаговую инструкцию, ссылки на нужные документы и обучающие материалы.

Важно, что в TEAMLY поиск можно гибко сузить, ограничив его область.

  • По всей базе знаний компании.

  • По конкретному пространству (например, «Отдел продаж», «Нормоконтроль», «Проект Х»).

  • По одному документу или цепочке связанных материалов.

Использование связки RAG+LLM даёт возможность, например, цитирования: ассистент формирует ответ с фразами вроде «Согласно п. 3.2 Регламента №45…» и даёт ссылку на конкретный пункт.

Эта связка так же, как и «обычный» ИИ запоминает историю диалога и умеет использовать контекст предыдущих вопросов при следующих взаимодействиях, что особенно важно для сложных кейсов.

При этом всём поддерживается многоуровневый доступ: RAG‑слой соблюдает установленные на пространства, статьи и прочие сущности БЗ права и не показывает закрытую информацию тому, кому видеть её не положено.

Главное, что при пополнении базы знаний ИИ подтягивает в ответ всю доступную новую информацию. Чтобы этот сегмент работал реально, необходимы интеграции БЗ с корпоративными чатами, подтягивание в неё обновлений законодательства. 

Ну и, пожалуй, чуть ли не главное применение RAG — генерация обучающих курсов на основе статей БЗ и тестов для этих курсов. Подробнее: ИИ-ассистент для крупного бизнеса. Как собрать обучающие курсы из вашей базы знаний

Заключение и практические советы

RAG‑революция — это не столько про очередную модную аббревиатуру, сколько про смену точки опоры. Вместо универсальных знаний «абстрактного интернета» ИИ наконец начинает говорить с бизнесом на языке его собственных документов. Связка LLM + RAG способна превратить хаотичную базу знаний в инструмент ежедневных решений — от кадровых до юридических.

RAG‑революция уже случилась: у нас больше нет оправдания «не знать», когда нужный ответ лежит в наших же договорах, регламентах и вики, а не в голове одного «незаменимого» эксперта. Если после этой статьи вы просто закроете вкладку — ничего не изменится: сотрудники продолжат копаться в «финалновыйточно_последний.docx», юристы — спорить о версиях договоров, а ИИ — иногда убедительно врать. Но если вы выберете один живой сценарий (HR‑справочник, поддержку клиентов или поиск по договорам), заведёте его в TEAMLY и честно привяжете к реальным данным через RAG, у вас впервые появится ассистент, который не подменяет здравый смысл магией нейросетей, а помогает бизнесу опираться на собственную память — прозрачно, воспроизводимо и без галлюцинаций.