Automatisation IA

Combien coûte un chatbot RAG sur vos documents internes ? Acheter ou construire

Un chatbot RAG sur les documents internes coûte de 3 000 à 10 000 € pour un périmètre limité et de 15 000 à 50 000 € pour une PME complète selon une agence française, plus environ 22 dollars par mois de modèle pour 20 personnes. VITON13 construit une version bornée dès 113 $.

RAG IA, c’est quoi : comment un chatbot répond-il avec vos documents ?

RAG signifie génération augmentée par récupération (retrieval-augmented generation). Quand quelqu’un pose une question, le système cherche d’abord dans vos documents, transmet les meilleurs passages à un modèle de langage et lui demande de répondre à partir d’eux, en citant la source. Pour la CNIL, c’est une recherche dans une base vectorisée, plus facile à mettre à jour et à tracer que le modèle seul.

Deux conséquences. Rien n’est réentraîné : vos fichiers vivent dans un index de recherche, hors du modèle. Et la réponse ne vaut pas mieux que la recherche : documents en double, périmés ou scannés sans texte donnent des réponses fluides et fausses.

Combien coûte un chatbot RAG sur vos documents internes ?

Les grilles publiées en 2026 divergent d’un facteur dix ou plus, car chacune chiffre un projet différent. Aucune n’est un devis.

Prix publiés pour développer un chatbot RAG sur documents internes (pages lues le 2026-10-04)
SourcePérimètre indiquéPrix de mise en placeFonctionnement indiqué
Koïno, cabinet IA, 15 août 2026Preuve de concept : quelques dizaines de documents, 1 source3 000–8 000 €100–300 € par mois
KoïnoRAG multi-équipes avec droits fins : plusieurs services, permissions20 000–40 000 €1 000–2 000 € par mois
Tensoria Studio, agence, 7 juil. 2026 (mise à jour 12 sept.)Un cas d’usage, quelques centaines de documents stables3 000–10 000 €50–300 € par mois
Tensoria StudioRAG PME complet : comptes utilisateurs, jusqu’à 10 000 documents15 000–50 000 €200–800 € par mois
VITON13Jusqu’à 200 documents approuvés, 3 sources, 3 groupes d’utilisateurs, 50 questions de test, 1 interfaceDès 113 $ assisté par IA ou 173 $ piloté par un spécialisteModèle, base vectorielle et hébergement payés aux fournisseurs
Chiffres tels que les sources les impriment. Elles sont écrites par ceux qui vendent le travail : elles montrent la dispersion, pas une moyenne du marché.

Lisez la ligne VITON13 comme un périmètre plus étroit, pas comme une remise : le forfait plafonne documents, sources, groupes et questions de test, et laisse hors prix la numérisation, les intégrations et les frais des fournisseurs.

Pourquoi deux devis pour le même chatbot RAG diffèrent-ils autant ?

  • Préparation des données : Hamza Shabbir l’estime à 30–40 % d’un budget de construction. Un dossier de texte propre se prépare en un jour, des années de PDF scannés en plusieurs semaines.
  • Droits d’accès : si chacun lit des documents différents, les règles doivent passer du système source à la recherche. Koïno dit que la gestion des droits sur données sensibles est le poste qui déraille le plus.
  • Entretien : Tensoria compte 15 à 25 % du coût initial par an en maintenance, plus l’hébergement (50 à 200 € par mois) et la base vectorielle (20 à 500 € par mois).
  • Qui construit : selon Hamza Shabbir, les agences facturent deux à trois fois un ingénieur indépendant pour le même périmètre.

Un outil prêt à l’emploi peut-il remplacer un RAG sur mesure ?

Pour une équipe déjà installée dans une suite, souvent oui. Le tableau reprend ce que chaque éditeur affiche aujourd’hui sur sa page tarifaire.

Outils prêts à l’emploi qui répondent avec vos documents (pages des éditeurs lues le 2026-10-04)
OutilPrix sur la page de l’éditeurCe qu’il litÀ vérifier avant d’acheter
ChatGPT Business20 $ par poste et par mois en paiement annuel, 25 $ en mensuel (la page en euros affiche 21 €) ; 2 à 200 employésFichiers de projets partagés ; Google Workspace, Slack, GitHub, Microsoft 365Les contrôles d’accès par rôle ne figurent que dans Enterprise ; la fenêtre de raisonnement fait environ 320 pages
Microsoft 365 Copilot Business18 $ par utilisateur et par mois en paiement annuel (promotion pour achats du 1er juil. au 31 déc. 2026, première année seulement ; tarif 21 $) ; 25,20 $ en mensuelContenus Microsoft 365Module complémentaire d’une offre Microsoft 365 éligible, jusqu’à 300 utilisateurs
Notion Business19,50 € par membre et par mois (le paiement annuel économise jusqu’à 20 %)Pages Notion et applications connectées comme SlackAgents au-delà de l’essai gratuit : 10 $ pour 1 000 crédits
Prix hors taxes ; les éditeurs américains facturent en dollars.

Les postes s’additionnent. Vingt personnes sur ChatGPT Business coûtent 4 800 $ par an en paiement annuel ou 6 000 $ en mensuel ; avec l’offre Copilot Business, 4 320 $ la première année ; sur Notion Business, 4 680 € (calculs de l’auteur). C’est la fourchette d’un petit projet : demandez ce qu’un poste ne fait pas, comme tourner dans votre site ou un bot Telegram, répondre au public ou appliquer des règles par document.

Combien coûte un chatbot RAG chaque mois ?

Trois compteurs tournent après le lancement : l’indexation des fichiers, le stockage de l’index et les jetons de chaque question. Indexer coûte presque rien : 200 documents de 20 pages, à environ 600 jetons la page, font 2,4 millions de jetons, et text-embedding-3-small d’OpenAI coûte 0,02 $ le million, soit environ cinq centimes. Le stockage pèse peu : la recherche de fichiers d’OpenAI inclut 1 Go gratuit.

Les questions sont le compteur principal. Prenons 3 000 jetons en entrée (consignes, cinq passages, question) et 400 en sortie, les tailles de Hamza Shabbir, et 20 personnes posant cinq questions par jour pendant 22 jours ouvrés : 2 200 questions.

Coût du modèle pour 2 200 questions par mois aux prix catalogue (lus le 2026-10-04, calculs de l’auteur)
Modèle (prix par million de jetons en entrée / sortie)Une question2 200 questions
GPT-6 Luna, OpenAI (0,10 $ / 0,50 $)0,0005 $1,10 $
Claude Haiku 4.5, Anthropic (1 $ / 5 $)0,005 $11 $
Claude Sonnet 5.5 et GPT-6.1 Sol (2 $ / 10 $)0,01 $22 $
Claude Opus 5.5 (4 $ / 20 $)0,02 $44 $
Claude Fable 5.1 et GPT-6 Astra (10 $ / 50 $)0,05 $110 $
Les jetons en cache coûtent le dixième ou moins : 0,20 $ le million pour Sonnet 5.5. Les points d’accès régionaux pour la résidence des données ajoutent environ 10 %.

Le modèle d’une petite équipe coûte donc des dizaines de dollars. Ajoutez 25 à 150 dollars par mois d’hébergement (Hamza Shabbir). Le coût qui compte est celui d’une personne qui garde les documents à jour et lit les questions restées sans réponse.

Où un chatbot RAG se trompe-t-il encore ?

  • Le mauvais passage est trouvé : un tableau ou une clause coupée en deux est traité à moitié, et un scan sans couche de texte ne donne rien à chercher.
  • Versions anciennes et doublons : donnez à chaque document un responsable et une date.
  • Les inventions subsistent : des chercheurs de Stanford ont constaté que des outils juridiques à base de RAG de LexisNexis et Thomson Reuters se trompaient dans 17 à 33 % des cas, moins qu’un chatbot généraliste mais loin de la suppression annoncée par certains éditeurs.
  • Fuites d’accès : l’OWASP range parmi les faiblesses majeures des applications LLM le contrôle d’accès faible sur les embeddings et les bases vectorielles partagées qui laissent fuir du contexte entre utilisateurs.

Une entreprise répond de ce que dit son assistant. Dans l’affaire Moffatt c. Air Canada (2024 BCCRT 149), un tribunal de Colombie-Britannique a écarté l’argument selon lequel le chatbot était une entité distincte et condamné la compagnie à verser 812,02 dollars canadiens à un client pour un conseil tarifaire erroné. Ce bot parlait au public, mais vos salariés agissent aussi d’après un assistant interne.

Que disent le RGPD et la CNIL d’un assistant sur documents internes ?

Si vos documents contiennent des données personnelles, le fournisseur du modèle qui les traite est votre sous-traitant : l’article 28 du RGPD exige un contrat écrit qui l’engage à suivre vos instructions, l’article 32 des mesures de sécurité adaptées au risque. La CNIL précise que l’entreprise qui connecte un assistant à sa propre base de connaissances répond de ce traitement, et qu’avec des données personnelles ou une documentation sensible un déploiement sur site est généralement plus sûr.

Ce n’est pas un conseil juridique. Demandez à votre DPO ou à un avocat où le fournisseur traite les données, ce qu’il conserve et si vos fichiers servent à l’entraînement.

Construire, acheter ou attendre : quelle liste de décision ?

  • Inutile de faire du RAG si toute votre bibliothèque tient en 100 à 200 pages et bouge peu : Hamza Shabbir propose un prompt en cache, et ChatGPT Business affiche une fenêtre de raisonnement d’environ 320 pages.
  • Achetez des postes si tout le monde travaille dans Microsoft 365, Google Workspace ou Notion, que vous êtes quelques dizaines et que les droits de la suite suffisent.
  • Prenez un constructeur de bots pour site web si le public est composé de visiteurs et le contenu public.
  • Construisez sur mesure si des groupes différents lisent des documents différents, si la réponse doit renvoyer au passage, si les sources sont dans plusieurs systèmes, si vous voulez votre interface ou des tests rejouables, ou si les données doivent rester dans une région choisie.

Comment VITON13 construit un assistant sur vos documents

Le forfait VITON13 est la version étroite de la construction décrite plus haut. Nous convenons des sources, de qui voit quoi et des questions les plus fréquentes ; nous indexons les documents approuvés avec leurs règles d’accès ; nous passons 50 questions de test avec réponse attendue, corrigeons les réponses fausses ou sans appui et fixons le seuil du « pas assez d’informations ». Après le test de votre équipe et les révisions, l’assistant part avec le rapport d’évaluation. En mode assisté par IA, l’IA fait un premier passage et une personne le vérifie ; en mode piloté par un spécialiste, celui-ci mène chaque étape avec l’appui de l’IA.

Assistant de connaissance RAG

Prix
113 $ assisté par IA ou 173 $ piloté par un spécialiste
Délai
10–18 jours ouvrés

Chatbot IA avec relais humain

Prix
73 $ assisté par IA ou 93 $ piloté par un spécialiste
Délai
5–8 jours ouvrés

Le prix final est fixé par écrit après une courte revue du périmètre.

Agents IA pour l’entreprise

Prix
73 $ assisté par IA ou 93 $ piloté par un spécialiste
Délai
5–8 jours ouvrés

Assisté par IA : l’IA prépare des brouillons dans des étapes définies, une personne dirige et vérifie chaque résultat. Piloté par un spécialiste : un spécialiste fait le travail, l’IA l’assiste.

Ce qui est inclus

  • Jusqu’à 200 documents approuvés indexés depuis 3 sources
  • Règles d’accès pour 3 groupes d’utilisateurs
  • 50 questions de test avec réponse attendue et un rapport rejouable après chaque changement
  • Une interface, un chat web ou un bot de messagerie, avec un lien vers la source sous chaque réponse
  • Un calendrier de mise à jour qui relit les documents modifiés et retire ceux qui sont supprimés
  • Délai : 10–18 jours ouvrés après validation du brief

Non inclus

  • Frais de modèle, de base vectorielle et d’hébergement, payés aux fournisseurs
  • Numérisation, nettoyage d’OCR ou réécriture de documents difficiles à lire
  • Actions dans d’autres systèmes, comme créer des tickets : c’est un agent IA, avec son propre périmètre
  • Toute promesse de précision au-delà des questions testées

Révisions: 2 tours de révision sur les livrables

Recevoir un devis sous 1 jour ouvré

Devis écrit sous 1 jour ouvré

Exemple

PILOTEPilote en cours

Aucun cas publié d’assistant sur documents pour l’instant

VITON13 n’a pas encore publié de cas d’assistant RAG sur les documents d’un client avec des réponses mesurées ; ce guide n’invente donc aucun chiffre de précision. Chaque nombre vient d’une source ci-dessous ou d’un calcul visible sur la page.

Ce que cela ne prouve pas

  • Le tableau du coût du modèle est un calcul sur les prix catalogue pour une taille de question supposée. Il ne montre ni la précision d’un assistant ni ce que coûtera votre usage.

Questions et réponses

Le RAG, est-ce la même chose qu’entraîner ChatGPT sur mes documents ?

Non. Vos fichiers sont indexés hors du modèle et les passages sont récupérés à la question : rien n’est réentraîné, et un fichier supprimé n’est plus utilisé après la mise à jour de l’index. Le réglage fin, comme le note Hamza Shabbir, change surtout le style et le format.

Combien de pages puis-je donner à ChatGPT avant d’avoir besoin d’un RAG ?

ChatGPT Business affiche une fenêtre de raisonnement de 256 000 jetons, environ 320 pages en entrée, et la réponse doit aussi y tenir. Hamza Shabbir suggère de charger dans un prompt en cache les textes de moins de 100 à 200 pages. Au-delà, ou si les fichiers changent chaque semaine, mieux vaut chercher d’abord.

Le chatbot peut-il répondre différemment selon les salariés ?

Oui, si les règles d’accès sont dans la recherche : un passage que la personne ne peut pas lire n’est même pas récupéré. Filtrer après que le modèle l’a vu arrive trop tard. L’OWASP met en garde contre les bases vectorielles partagées. Le forfait VITON13 applique des règles pour 3 groupes.

Comment tester un assistant RAG avant le lancement ?

Rédigez de vraies questions avec réponse attendue et source, rejouez-les après chaque changement et vérifiez séparément la recherche et la réponse : le bon passage est-il trouvé, la réponse lui est-elle fidèle ? Le forfait VITON13 en inclut 50 ; Hamza Shabbir chiffre 50 à 100 questions à 1 000–3 000 dollars.

Faut-il une base de données vectorielle à part ?

Pas toujours. Hamza Shabbir juge que Postgres avec l’extension pgvector suffit pour la plupart des bases jusqu’à quelques millions de vecteurs, pour 0 à 50 dollars de plus par mois. Les frais de base vectorielle sont hors forfait VITON13.

Sources

  1. OpenAI, tarifs de l’API —
  2. Anthropic, tarifs de Claude —
  3. OpenAI, tarifs de ChatGPT Business —
  4. Microsoft, tarifs de Copilot pour les entreprises —
  5. Notion, tarifs —
  6. Koïno, Prix d’un RAG en 2026 —
  7. Tensoria Studio, Prix et coût d’un RAG en entreprise —
  8. Hamza Shabbir, coût d’un chatbot RAG —
  9. Magesh et al. (Stanford), Hallucination-Free? —
  10. OWASP, LLM08:2025 Vector and Embedding Weaknesses —
  11. Moffatt c. Air Canada, 2024 BCCRT 149 —
  12. EUR-Lex, RGPD, articles 28 et 32 —
  13. CNIL, Questions-réponses sur l’IA générative —

À propos de l’auteur

Vitalii Tarasov

Fondateur de VITON13 Studio · Dubaï, Émirats arabes unis

Vitalii Tarasov a fondé VITON13 en 2026 et dirige VITON13 Studio depuis son bureau de Dubaï. Il répond de chaque projet du studio : le périmètre et le prix écrits, la direction du travail et la vérification avant livraison. Les prix du studio cités dans ce guide sont lus sur les pages de service : ce sont ceux qu’on vous y proposerait.

À propos de VITON13

Services liés à ce guide