Automatización con IA
¿Cuánto cuesta un chatbot RAG con los documentos de tu empresa? Comprar o construir
Un chatbot RAG con los documentos de la empresa cuesta entre 5.000 € y 8.000 € como piloto en una consultora española y entre 12.000 € y 30.000 € con permisos por usuario y varias fuentes, más unos 22 dólares al mes de modelo para 20 empleados. VITON13 construye una versión acotada desde 113 $.
¿Qué es RAG en IA y cómo responde un chatbot con documentos de empresa?
RAG significa generación aumentada por recuperación (retrieval-augmented generation). Cuando alguien pregunta, el sistema busca primero en tus documentos, pasa los mejores fragmentos a un modelo de lenguaje y le pide que responda solo con ellos, citando la fuente. Es un examen a libro abierto: la respuesta sale de la página encontrada.
Dos consecuencias. No se reentrena nada: tus archivos viven en un índice de búsqueda fuera del modelo. Y la respuesta nunca supera a la búsqueda, así que documentos duplicados, obsoletos o escaneados sin texto dan respuestas fluidas y erróneas.
¿Cuánto cuesta un chatbot RAG con los documentos de tu empresa?
Los presupuestos publicados en 2026 difieren en un factor de diez o más, porque cada uno describe un proyecto distinto. Ninguno es una oferta.
| Fuente y tipo | Alcance indicado | Precio de desarrollo | Coste de uso indicado |
|---|---|---|---|
| MERIDIAN, consultora de datos e IA en Tarragona, actualizado el 12 jul 2026 | Piloto con documentos acotados y un equipo; despliegue con permisos por usuario, varias fuentes e integración | 5.000–8.000 € el piloto; 12.000–30.000 € el despliegue | El modelo se paga por uso y es una fracción del total; sin importe |
| RoviDev, agencia, precios orientativos 2026 | Copiloto interno con RAG sobre documentación corporativa | 7.000–15.000 € | No indicado |
| Panorama Systems, estudio de software de EE. UU., 2026 | Búsqueda sobre tus documentos con evaluación; 4–8 semanas | 8.000–25.000 $; mercado 10.000–70.000 $ | No indicado |
| VITON13 | Hasta 200 documentos aprobados, 3 fuentes, 3 grupos de usuarios, 50 preguntas de prueba y 1 interfaz | Desde 113 $ asistido por IA o 173 $ dirigido por especialistas | Modelo, base vectorial y alojamiento se pagan a los proveedores |
La fila de VITON13 es un alcance más estrecho, no un descuento: el paquete limita documentos, fuentes, grupos y preguntas de prueba, y deja fuera el escaneo, las integraciones y las tarifas de los proveedores.
¿Por qué dos presupuestos del mismo chatbot difieren tanto?
- Estado de los datos: según Panorama Systems, lo que más pesa no es el modelo, sino cuántos formatos hay, cuántos son escaneos, cuántos documentos se contradicen y cuál es la versión vigente. Hamza Shabbir lo cifra en un 30–40 % del presupuesto.
- Permisos por usuario: si cada persona ve documentos distintos, las reglas deben viajar del sistema de origen al buscador. MERIDIAN lo llama la parte más delicada.
- Evaluación: Hamza Shabbir valora un conjunto de 50–100 preguntas con respuesta esperada en 1.000–3.000 dólares.
- Quién lo construye: según Hamza Shabbir, las agencias piden dos o tres veces lo que un ingeniero autónomo por el mismo alcance.
¿Basta con Copilot, ChatGPT u otra herramienta lista para usar?
Si el equipo ya trabaja en una sola suite, a menudo sí. MERIDIAN lo resume así: Copilot cubre SharePoint y Office con poco esfuerzo, pero da menos control sobre fuentes, citas y calidad. La tabla recoge lo que cada proveedor publica hoy.
| Herramienta | Precio en la página del proveedor | Qué lee | A comprobar antes de comprar |
|---|---|---|---|
| ChatGPT Business | 20 $ por puesto al mes con pago anual, 25 $ mensual (la página en euros muestra 21 €); de 2 a 200 empleados | Archivos en proyectos compartidos; Google Workspace, Slack, GitHub, Microsoft 365 | Los controles de acceso por roles figuran solo en Enterprise; la ventana de razonamiento son unas 320 páginas |
| Microsoft 365 Copilot Business | 18 $ por usuario al mes con pago anual (promoción para compras del 1 jul al 31 dic 2026, solo el primer año; lista 21 $); 25,20 $ mensual | Contenido de Microsoft 365 | Complemento de un plan Microsoft 365 apto, hasta 300 usuarios |
| Notion Business | 19,50 € por miembro al mes (el pago anual ahorra hasta un 20 %) | Páginas de Notion y apps conectadas como Slack | Los agentes tras la prueba gratuita: 10 $ por 1.000 créditos |
Los puestos se acumulan. Veinte personas en ChatGPT Business cuestan 4.800 $ al año con pago anual o 6.000 $ mensual; con la oferta de Copilot Business, 4.320 $ el primer año; en Notion Business, 4.680 € (aritmética propia). Es el rango de un piloto, así que pregunta qué no hace un puesto: funcionar dentro de tu web o de un bot de Telegram, atender al público o aplicar reglas por documento.
¿Cuánto cuesta mantener un chatbot RAG cada mes?
Tras el lanzamiento corren tres contadores: indexar los archivos, guardar el índice y los tokens de cada pregunta. Indexar casi no cuesta: 200 documentos de 20 páginas, a unos 600 tokens por página, son 2,4 millones de tokens, y text-embedding-3-small de OpenAI cuesta 0,02 $ por millón: unos cinco céntimos. Guardar el índice tampoco pesa: la búsqueda de archivos de OpenAI incluye 1 GB gratis.
Las preguntas son el contador principal. Supón 3.000 tokens de entrada (instrucciones, cinco fragmentos y la pregunta) y 400 de salida, los tamaños que usa Hamza Shabbir, y 20 personas con cinco preguntas al día durante 22 días laborables: 2.200 preguntas.
| Modelo (precio por millón de tokens de entrada / salida) | Una pregunta | 2.200 preguntas |
|---|---|---|
| GPT-6 Luna, OpenAI (0,10 $ / 0,50 $) | 0,0005 $ | 1,10 $ |
| Claude Haiku 4.5, Anthropic (1 $ / 5 $) | 0,005 $ | 11 $ |
| Claude Sonnet 5.5 y GPT-6.1 Sol (2 $ / 10 $) | 0,01 $ | 22 $ |
| Claude Opus 5.5 (4 $ / 20 $) | 0,02 $ | 44 $ |
| Claude Fable 5.1 y GPT-6 Astra (10 $ / 50 $) | 0,05 $ | 110 $ |
Así, el modelo de un equipo pequeño cuesta decenas de dólares. Suma 25–150 dólares al mes de alojamiento (Hamza Shabbir). El coste que importa es una persona que mantenga los documentos al día y lea las preguntas sin respuesta.
¿Puede un chatbot RAG inventarse respuestas o filtrar documentos?
- Se recupera el fragmento equivocado: una tabla o cláusula partida entre dos trozos se responde con la mitad, y un escaneo sin capa de texto no da nada que buscar.
- Versiones viejas y duplicados: MERIDIAN lo resume así: documentos desactualizados dan respuestas desactualizadas. Dale a cada documento un responsable y una fecha.
- Las invenciones no desaparecen: investigadores de Stanford hallaron que herramientas jurídicas con RAG de LexisNexis y Thomson Reuters alucinaban entre el 17 % y el 33 % de las veces, menos que un chatbot general pero lejos de la eliminación anunciada por algunos proveedores.
- Fugas de acceso: OWASP cuenta entre las debilidades principales de las aplicaciones LLM el control de acceso débil sobre los embeddings y los almacenes vectoriales compartidos que filtran contexto entre usuarios.
Una empresa responde de lo que dice su asistente. En Moffatt v. Air Canada (2024 BCCRT 149) un tribunal de Columbia Británica rechazó que el chatbot de la aerolínea fuese una entidad aparte y le ordenó pagar 812,02 dólares canadienses a un cliente por un consejo erróneo sobre tarifas. Era un bot público, pero tus empleados también actúan según las respuestas de un asistente interno.
¿Qué exige el RGPD si los documentos contienen datos personales?
Si tus documentos incluyen datos personales, el proveedor del modelo que los trata es tu encargado del tratamiento. El artículo 28 del RGPD exige un contrato escrito que lo ligue a tus instrucciones, y el artículo 32, medidas de seguridad adecuadas al riesgo. MERIDIAN añade que quien no puede ver un documento tampoco debe poder preguntárselo al asistente.
Esto no es asesoramiento jurídico. Pregunta a tu delegado de protección de datos o a un abogado dónde trata el proveedor los datos, qué conserva y si usa tus archivos para entrenar.
¿Construir, comprar o esperar? Una lista para decidir
- No hace falta RAG si toda tu biblioteca tiene menos de unas 100–200 páginas y cambia poco: Hamza Shabbir propone cargarla en un prompt con caché, y ChatGPT Business indica una ventana de razonamiento de unas 320 páginas.
- Compra un plan por puestos si todos trabajáis en Microsoft 365, Google Workspace o Notion, sois unas decenas y los permisos de la suite bastan.
- Usa un constructor de bots para web si el público son visitantes y el contenido es público.
- Construye a medida si grupos distintos leen documentos distintos, la respuesta debe enlazar al fragmento, las fuentes están en varios sistemas, necesitas tu propia interfaz o pruebas repetibles, o los datos deben quedarse en una región concreta.
Cómo construye VITON13 un asistente con tus documentos
El paquete de VITON13 es la versión estrecha de la construcción de arriba. Acordamos fuentes, permisos y preguntas frecuentes; indexamos los documentos aprobados con sus reglas de acceso; lanzamos 50 preguntas de prueba con respuesta esperada, corregimos las respuestas erróneas o sin respaldo y fijamos el umbral del «no hay información suficiente». Tras la prueba de tu equipo y las revisiones, sale con el informe de evaluación. En el modo asistido por IA, la IA hace una primera pasada y una persona la revisa; en el modo dirigido por especialistas, un especialista lleva cada paso con ayuda de la IA.
Asistente de conocimiento RAG
- Precio
- 113 $ asistido por IA o 173 $ dirigido por especialistas
- Plazo
- 10–18 días laborables
Chatbot con IA y traspaso a una persona
- Precio
- 73 $ asistido por IA o 93 $ dirigido por especialistas
- Plazo
- 5–8 días laborables
El precio final se fija por escrito tras una breve revisión del alcance.
Agentes de IA para empresas
- Precio
- 73 $ asistido por IA o 93 $ dirigido por especialistas
- Plazo
- 5–8 días laborables
Asistido por IA: la IA prepara borradores en pasos definidos y una persona dirige y revisa cada resultado. Dirigido por especialistas: un especialista hace el trabajo y la IA ayuda.
Qué incluye
- Hasta 200 documentos aprobados indexados desde 3 fuentes
- Reglas de acceso para 3 grupos de usuarios
- 50 preguntas de prueba con respuesta esperada y un informe que puedes repetir tras los cambios
- Una interfaz, un chat web o un bot de mensajería, con un enlace a la fuente bajo cada respuesta
- Un calendario de actualización que relee los documentos modificados y retira los eliminados
- Plazo: 10–18 días laborables tras la aprobación del briefing
No incluye
- Tarifas de modelo, base de datos vectorial y alojamiento, que pagas a los proveedores
- Escaneo, limpieza de OCR o reescritura de documentos difíciles de leer
- Acciones en otros sistemas, como crear tickets: eso es un agente de IA, con su propio alcance
- Cualquier promesa de precisión más allá de las preguntas probadas
Revisiones: 2 rondas de revisión sobre los entregables
Recibir presupuesto en 1 día laborablePresupuesto por escrito en 1 día laborable
Ejemplo
PILOTOPiloto en curso
Todavía no hay un caso publicado de asistente con documentos
VITON13 aún no ha publicado un caso de asistente RAG con los documentos de un cliente y respuestas medidas, así que esta guía no inventa cifras de precisión. Cada número procede de una fuente de abajo o de un cálculo visible en la página.
Qué no demuestra
- La tabla de coste de modelo es aritmética con precios de lista para un tamaño de pregunta supuesto. No muestra lo preciso que es ningún asistente ni lo que costará tu uso.
Preguntas y respuestas
¿RAG es lo mismo que entrenar ChatGPT con mis documentos?
No. Tus archivos se indexan fuera del modelo y los fragmentos se recuperan cuando llega la pregunta, así que no se reentrena nada y un archivo borrado deja de usarse al actualizar el índice. El ajuste fino, como señala Hamza Shabbir, cambia sobre todo el estilo y el formato.
¿Cuántas páginas puedo dar a ChatGPT antes de necesitar RAG?
ChatGPT Business indica una ventana de razonamiento de 256.000 tokens, unas 320 páginas de entrada, y la respuesta también debe caber. Hamza Shabbir sugiere cargar en un prompt con caché los textos de menos de 100–200 páginas. Más allá, o si los archivos cambian cada semana, conviene buscar primero.
¿El chatbot puede mostrar respuestas distintas a cada empleado?
Sí, si las reglas de acceso están dentro de la recuperación: un fragmento que la persona no puede leer ni se recupera. Filtrar cuando el modelo ya lo ha visto llega tarde. OWASP avisa de los almacenes vectoriales compartidos. El paquete de VITON13 aplica reglas para 3 grupos.
¿Cómo pruebo un asistente RAG antes de lanzarlo?
Redacta preguntas reales con respuesta esperada y fuente, repítelas tras cada cambio y revisa por separado la búsqueda y la respuesta: ¿se encontró el fragmento correcto y es fiel la respuesta? El paquete de VITON13 incluye 50; Hamza Shabbir valora 50–100 preguntas en 1.000–3.000 dólares.
¿Necesito una base de datos vectorial aparte?
No siempre. Hamza Shabbir sostiene que Postgres con la extensión pgvector basta para la mayoría de las bases de conocimiento de hasta unos millones de vectores, por 0–50 dólares al mes adicionales. Las tarifas de la base vectorial quedan fuera del paquete de VITON13.
Fuentes
- OpenAI, precios de la API —
- Anthropic, precios de Claude —
- OpenAI, precios de ChatGPT Business —
- Microsoft, precios de Copilot para empresas —
- Notion, precios —
- MERIDIAN, Chatbot interno de documentos para empresa —
- RoviDev, Chatbot IA RAG con tus datos —
- Panorama Systems, ¿Cuánto cuesta un chatbot RAG? —
- Hamza Shabbir, coste de un chatbot RAG —
- Magesh y otros (Stanford), Hallucination-Free? —
- OWASP, LLM08:2025 Vector and Embedding Weaknesses —
- Moffatt v. Air Canada, 2024 BCCRT 149 —
- EUR-Lex, RGPD, artículos 28 y 32 —