AI-автоматизация
Что такое RAG и сколько стоит чат-бот по документам компании?
RAG — это поиск по вашим документам перед ответом нейросети. Разработка такого бота у российских подрядчиков стоит от 200–300 тысяч рублей за простой вариант, у зарубежных фрилансеров MVP — от $4 000, а модель на 2 200 вопросов в месяц обходится в 500–6 000 рублей. VITON13 делает ограниченную версию от $113.
Что такое RAG простыми словами?
RAG (retrieval-augmented generation, «генерация с опорой на поиск») — способ заставить нейросеть отвечать по вашим документам. Перед ответом система ищет в базе файлов подходящие фрагменты, передаёт их модели и просит ответить только по ним, со ссылкой на источник. Это экзамен с открытой книгой: ответ строится по найденной странице, а не по памяти.
Отсюда два следствия. Модель не дообучается: файлы лежат в поисковом индексе рядом с ней, а не внутри. И ответ не лучше поиска: дубли, устаревшие версии и сканы без текста дают уверенные, но неверные ответы.
Сколько стоит разработка чат-бота по документам на RAG?
Опубликованные оценки расходятся в десять и более раз, потому что описывают разные проекты. Ни одна из них не является коммерческим предложением.
| Источник | Что входит | Цена разработки | Эксплуатация |
|---|---|---|---|
| vc.ru, статья о RAG, 3 октября 2026 | Со слов автора: российские подрядчики, от простого бота до системы с CRM или 1С | от 200–300 тыс. ₽ до 1,5–5 млн ₽ | Токены и хранение считаются отдельно |
| SINTEZ, агентство, страница услуги | RAG-система по документам компании со ссылками на источники | от 500 000 ₽, срок от 4 недель | Не указано |
| Хамза Шаббир, фрилансер, 9 июня 2026 (в долларах) | MVP: один источник. Продакшн: несколько источников, оценка качества, мониторинг | $4 000–$12 000 MVP; $15 000–$40 000+ продакшн | $5–$30 за 1 000 вопросов плюс $25–$150 в месяц |
| VITON13 | До 200 утверждённых документов, 3 источника, 3 группы пользователей, 50 тестовых вопросов, 1 интерфейс | От $113 с помощью ИИ или $173 под руководством специалиста | Модель, векторная база и хостинг оплачиваются провайдерам |
Строку VITON13 стоит читать как более узкий объём, а не скидку: пакет ограничивает число документов, источников, групп и тестовых вопросов, а распознавание сканов, интеграции и платежи провайдерам в цену не входят.
Почему два предложения на один и тот же бот отличаются в разы?
- Подготовка данных: по оценке Хамзы Шаббира, это 30–40% бюджета. Папка чистого текста готовится за день, архив сканов — за недели. Распознавание печатного текста в Yandex AI Studio стоит 0,1321 ₽ за страницу, то есть около 530 ₽ за 4 000 страниц, но проверка результата — работа человека.
- Источники: каждая система (диск, вики, почта) требует своего разбора файлов.
- Права доступа: если сотрудники читают разные документы, правила нужно перенести из системы-источника в поиск, а не фильтровать ответ задним числом.
- Оценка качества: набор из 50–100 вопросов с эталонными ответами Хамза оценивает в $1 000–$3 000. В пакете VITON13 есть 50 тестовых вопросов.
- Где живут данные: размещение на своих серверах или в российском облаке добавляет расходы на хостинг и сопровождение.
- Кто делает: по словам Хамзы, агентства просят в два-три раза больше одиночного инженера за тот же объём.
Готовый сервис или своя сборка: что есть и сколько стоит?
Если команда уже сидит в одной экосистеме, готового сервиса часто хватает. В таблице — цены с официальных страниц на сегодня.
| Сервис | Цена на странице | Откуда отвечает | На что обратить внимание |
|---|---|---|---|
| Алиса AI для бизнеса (Яндекс 360) | 1 199 ₽ за сотрудника в месяц; новым организациям три месяца бесплатно по акции с 8 сентября по 31 декабря 2026 года | База знаний организации и сервисы Яндекс 360, со ссылками на источники | Тариф до 250 сотрудников; возможности доступны только в РФ; данные по умолчанию не идут на обучение |
| ChatGPT Business (OpenAI) | $20 за место в месяц при оплате за год, $25 помесячно; 2–200 сотрудников | Файлы в общих проектах; Google Workspace, Slack, GitHub, Microsoft 365 | Проверьте, доступен ли сервис вашей компании и как его оплатить; ролевой доступ указан только для Enterprise |
Для 20 сотрудников «Алиса AI для бизнеса» после акции стоит 23 980 ₽ в месяц, около 287 760 ₽ в год (арифметика автора); ChatGPT Business — $4 800 в год при оплате за год. Это диапазон простой разработки, поэтому спрашивайте, чего подписка не умеет: работать внутри вашего сайта или Telegram-бота, отвечать посторонним, применять правила доступа на уровне документа.
Сколько стоит работа RAG-бота в месяц?
После запуска работают три счётчика: индексация файлов, хранение индекса и токены на каждый вопрос. Индексация почти бесплатна: 200 документов по 20 страниц, примерно 600 токенов на страницу, — это 2,4 млн токенов. Эмбеддинги стоят 0,0101 ₽ за 1 000 токенов в Yandex AI Studio и 0,014 ₽ в GigaChat, то есть 24–34 рубля.
Основной счётчик — вопросы. Возьмём вопрос на 3 000 входящих и 400 исходящих токенов (инструкция, пять найденных фрагментов и сам вопрос; такие размеры использует Хамза Шаббир) и 20 человек, которые задают по пять вопросов в день 22 рабочих дня: 2 200 вопросов.
| Модель (цена за 1 000 токенов) | Один вопрос | 2 200 вопросов |
|---|---|---|
| GigaChat Lite (0,065 ₽) | 0,22 ₽ | 486 ₽ |
| Alice AI LLM Flash (0,1 ₽ вход, 0,2 ₽ выход) | 0,38 ₽ | 836 ₽ |
| GigaChat Pro (0,5 ₽) | 1,70 ₽ | 3 740 ₽ |
| Alice AI LLM (0,5 ₽ вход, 1,2 ₽ выход) | 1,98 ₽ | 4 356 ₽ |
| GigaChat Max (0,65 ₽) | 2,21 ₽ | 4 862 ₽ |
| YandexGPT Pro 5.1 (0,8 ₽ вход и выход) | 2,72 ₽ | 5 984 ₽ |
Итого модель для небольшой команды стоит от сотен до нескольких тысяч рублей в месяц. Добавьте хостинг: по оценке Хамзы, $25–$150 в месяц. Главная статья расходов — человек, который держит документы актуальными и читает вопросы, оставшиеся без ответа.
Где RAG-боты всё ещё ошибаются?
- Находится не тот фрагмент: таблица или пункт, разрезанные пополам, дают ответ по половине условия, а скан без текстового слоя поиск не видит.
- Старые версии и дубли: в примере vc.ru бесплатная доставка раньше была от 3 000 ₽, теперь от 5 000 ₽, но старые условия никто не удалил, и поиск приносит оба куска.
- Выдумки не исчезают: в исследовании Стэнфорда юридические RAG-сервисы LexisNexis и Thomson Reuters ошибались в 17–33% ответов, меньше, чем универсальный чат-бот, но далеко от заявлений вендоров.
- Утечка прав: OWASP называет слабый контроль доступа к векторным базам и общие хранилища, где контекст перетекает между пользователями, одной из главных уязвимостей LLM-приложений.
- Отравленные документы: файл со скрытыми инструкциями может подтолкнуть ответ; OWASP советует проверять источники и вести журнал поиска.
Компания отвечает за слова своего ассистента. В деле Moffatt v. Air Canada (2024 BCCRT 149) трибунал Британской Колумбии отклонил довод авиакомпании, что чат-бот — отдельное лицо, и обязал её выплатить клиенту 812,02 канадского доллара за неверный совет о тарифе. Бот был клиентским, но сотрудники так же действуют по ответам внутреннего ассистента.
Что делать с 152-ФЗ, если в документах есть персональные данные?
Часть 5 статьи 18 закона 152-ФЗ в редакции от 28 февраля 2025 года не допускает запись, хранение и извлечение персональных данных граждан России с использованием баз данных за пределами России, кроме случаев из пунктов 2, 3, 4 и 8 части 1 статьи 6. Для RAG это значит: если в документах есть ФИО, телефоны или паспортные данные, файлы, индекс и сервер приложения должны находиться в России, а отправку таких текстов в зарубежный API стоит разобрать с юристом.
Это не юридическая консультация. Спросите юриста или ответственного за персональные данные, где провайдер обрабатывает данные, что он хранит и используются ли файлы для обучения.
Собирать, покупать или пока ничего не делать: какой чек-лист ваш?
- RAG не нужен, если вся библиотека — до 100–200 страниц и редко меняется: Хамза Шаббир советует загрузить её в кэшируемый запрос, а окно рассуждений ChatGPT Business — около 320 страниц.
- Берите готовый сервис, если команда уже в одной экосистеме, пользователей десятки, а встроенных прав доступа хватает.
- Берите конструктор бота для сайта, если аудитория — посетители, а содержимое публичное.
- Собирайте своё, если разные группы читают разные документы, ответ должен ссылаться на фрагмент, источники лежат в нескольких системах, нужен свой интерфейс (сайт, Telegram) или повторяемый набор тестов, либо данные должны остаться в российском контуре.
Как VITON13 собирает ассистента по документам
Пакет VITON13 — узкая версия сборки, описанной выше. Мы согласуем источники, кто что может видеть и какие вопросы задают чаще всего; индексируем утверждённые документы и подключаем правила доступа; затем прогоняем 50 тестовых вопросов с эталонными ответами, исправляем неверные и неподтверждённые ответы и настраиваем порог для понятного ответа «недостаточно информации». После проверки вашей командой и раундов правок ассистент запускается вместе с отчётом об оценке. В режиме «с помощью ИИ» нейросеть делает первый проход, а человек проверяет его; в режиме «под руководством специалиста» каждый шаг ведёт специалист, а ИИ ему помогает.
RAG-ассистент по базе знаний
- Цена
- $113 с помощью ИИ или $173 под руководством специалиста
- Срок
- 10–18 рабочих дней
ИИ-чат-бот с передачей оператору
- Цена
- $73 с помощью ИИ или $93 под руководством специалиста
- Срок
- 5–8 рабочих дней
Итоговая цена фиксируется письменно после короткой оценки объёма.
AI-агенты для бизнеса
- Цена
- $73 с помощью ИИ или $93 под руководством специалиста
- Срок
- 5–8 рабочих дней
С помощью ИИ: ИИ готовит черновики в заданных шагах, человек задаёт направление и проверяет каждый результат. Под руководством специалиста: работу делает специалист, ИИ помогает.
Что входит
- До 200 утверждённых документов, проиндексированных из 3 источников
- Правила доступа для 3 групп пользователей: никто не получит ответ из документа, который ему нельзя читать
- 50 тестовых вопросов с эталонными ответами и отчёт, который можно перезапускать после изменений
- Один интерфейс, веб-чат или бот в мессенджере, со ссылкой на источник под каждым ответом
- Одно расписание обновления: изменённые документы перечитываются, удалённые убираются
- Срок: 10–18 рабочих дней после утверждения брифа
Не входит
- Оплата модели, векторной базы и хостинга: её вы платите провайдерам
- Сканирование, распознавание и переписывание плохо читаемых документов
- Действия в других системах, например создание заявок: это ИИ-агент со своим объёмом работ
- Любые обещания точности сверх проверенных тестовых вопросов
Правки: 2 раунда правок по сдаваемым материалам
Получить смету за 1 рабочий деньСмета за 1 рабочий день
Пример
ПИЛОТПилот в работе
Опубликованного кейса по ассистенту на документах пока нет
У VITON13 пока нет опубликованного кейса с RAG-ассистентом на документах клиента и измеренными ответами, поэтому в руководстве нет выдуманных показателей точности. Каждая цифра взята из источника ниже или из арифметики на странице.
Чего это не доказывает
- Таблица платы за модель — арифметика по прайсам для одного условного размера вопроса. Она не показывает, насколько точен какой-либо ассистент и сколько будет стоить ваша нагрузка.
Вопросы и ответы
RAG — это то же самое, что обучить нейросеть на моих документах?
Нет. Файлы индексируются вне модели, а фрагменты достаются в момент вопроса, поэтому ничего не дообучается, а удалённый файл перестаёт использоваться после обновления индекса. Дообучение, как отмечает Хамза Шаббир, в основном меняет стиль и формат ответов, а не добавляет знания.
Нужна ли отдельная векторная база данных?
Не всегда. Хамза Шаббир считает, что расширения pgvector в обычной базе Postgres хватает для большинства баз знаний до нескольких миллионов векторов, это $0–$50 в месяц сверху. Платежи за векторную базу идут провайдеру и в пакет VITON13 не входят.
Может ли бот давать разные ответы разным сотрудникам?
Да, если правила доступа встроены в поиск: фрагмент, который человеку читать нельзя, просто не извлекается. Фильтровать после того, как модель его увидела, поздно. OWASP предупреждает об общих векторных хранилищах, где контекст перетекает между пользователями. Пакет VITON13 применяет правила для 3 групп.
Как проверить RAG-бота до запуска?
Составьте реальные вопросы с эталонным ответом и источником, прогоняйте их после каждого изменения и проверяйте отдельно поиск и ответ: найден ли нужный фрагмент и верен ли ответ ему. В пакет VITON13 входит 50 вопросов; у Хамзы Шаббира набор из 50–100 вопросов стоит $1 000–$3 000.
Сколько времени занимает разработка?
В пакете VITON13 срок — 10–18 рабочих дней после утверждения брифа. Агентство SINTEZ называет срок от 4 недель, а MVP у фрилансера Хамзы Шаббира, по его словам, занимает 2–4 недели. Сроки растут вместе с числом источников и сложностью прав доступа.
Что прислать VITON13, чтобы начать?
Пришлите утверждённые документы или места, где они лежат, кто какие из них может видеть и вопросы, которые задают чаще всего. Сканы и плохо читаемые файлы нужно очистить до индексации, и эта чистка в пакет не входит.
Источники
- Yandex AI Studio, правила тарификации —
- Сбер, тарифы GigaChat API для юрлиц —
- Яндекс 360, Алиса AI для бизнеса —
- OpenAI, цены ChatGPT Business —
- vc.ru, Что такое RAG простыми словами —
- SINTEZ, RAG-система по документам компании —
- Хамза Шаббир, стоимость RAG-чат-бота в 2026 году —
- КонсультантПлюс, 152-ФЗ, статья 18 —
- Magesh и др. (Стэнфорд), Hallucination-Free? —
- OWASP, LLM08:2025 Vector and Embedding Weaknesses —
- Moffatt v. Air Canada, 2024 BCCRT 149 —