RAG-системы в корпоративном обучении: база знаний, которая отвечает на вопросы

Средний сотрудник тратит 3.6 часа в неделю на поиск информации — данные McKinsey (2024). В компании на 500 человек это 7200 часов в месяц, или четыре полных FTE, которые занимаются не работой, а навигацией по регламентам. RAG-система (Retrieval-Augmented Generation) решает эту проблему радикально: сотрудник задаёт вопрос на русском языке — и получает ответ со ссылкой на конкретный документ.

Как это работает: не магия, а пайплайн из трёх шагов

RAG — это связка из трёх компонентов:

  1. Индексация. Все документы компании (регламенты, инструкции, FAQ, записи звонков) разбиваются на чанки по 500-1000 токенов и переводятся в векторное представление. Каждый чанк получает эмбеддинг — координаты в 1536-мерном пространстве, где семантически близкие тексты лежат рядом.
  2. Поиск. Когда сотрудник задаёт вопрос, система переводит его в такой же эмбеддинг и ищет ближайшие 3-5 чанков по косинусному расстоянию.
  3. Генерация. Найденные чанки + вопрос сотрудника подаются в LLM, которая синтезирует ответ на основе релевантных документов — без галлюцинаций, потому что модель опирается на конкретные источники.
Архитектура RAG-системы
Трёхшаговый пайплайн RAG: индексация → поиск → генерация

Где RAG-система окупается быстрее всего

Три сценария с максимальным ROI:

Пять ошибок внедрения RAG

  1. Плохой чанкинг. Разбивка по 200 токенов теряет контекст. Разбивка по 2000 — размывает релевантность. Оптимум: 500-800 токенов с перекрытием 10-15%.
  2. Устаревшая база. RAG с документами двухлетней давности токсичнее, чем отсутствие RAG. Нужен пайплайн обновления: при изменении регламента → автообновление эмбеддингов.
  3. Нет разграничения доступа. Сотрудник не должен через RAG получать доступ к документам совета директоров.
  4. Игнорирование метаданных. Фильтрация по дате, отделу и типу документа повышает точность поиска на 40-60%.
  5. Отсутствие метрик. Без трекинга «какой процент ответов пользователи оценили как полезные» RAG деградирует незаметно.

FAQ

Сколько стоит RAG для компании на 500 человек?
Базовая версия (OpenAI embeddings + Pinecone + кастомный чат-бот): 200-400 тыс. руб. на запуск, 20-40 тыс./мес на поддержку.

Чем RAG отличается от файнтюнинга?
RAG подмешивает релевантные документы в промпт. Файнтюнинг меняет веса модели. RAG обновляется мгновенно при изменении документа. Файнтюнинг требует переобучения.

Никита Медведев — бизнес-тренер по ИИ. Помогаю внедрять RAG-системы в корпоративное обучение. Записаться на консультацию →