Call-bot.ai

Les coûts d'un callbot que les grilles tarifaires ne montrent pas

Le tarif à la minute affiché par les plateformes de callbot est le poste le plus simple à budgéter, et rarement celui qui décide du résultat. Les grilles publiques décrivent le coût de faire tourner un agent ; elles ne décrivent ni le coût de le mettre en état de tourner, ni celui de le maintenir juste. Ce sont ces postes-là qui font basculer un budget.

Un décideur qui compare deux plateformes de callbot compare généralement deux nombres : un prix par minute et un abonnement mensuel. C'est l'information que les éditeurs publient, et elle est exacte. Le problème n'est pas qu'elle soit fausse, c'est qu'elle répond à une question différente de celle que le décideur se pose. La grille répond à « combien coûte une minute de conversation ». Le budget, lui, doit répondre à « combien coûte un appel traité correctement, sur trois ans, dans mon système d'information ».

Entre les deux, il y a cinq familles de postes que les grilles ne montrent pas. Aucune n'est cachée au sens malveillant : elles sont simplement hors du périmètre de ce que l'éditeur vend. Si vous ne savez pas encore ce que recouvre cette brique, commencez par Qu'est-ce qu'un callbot ?.

La grille décrit un coût de fonctionnement, pas un coût de projet

Première chose à comprendre : le prix affiché est presque toujours une couche parmi plusieurs, et l'éditeur le dit lui-même.

Sur la page tarifaire de Vapi relevée en septembre 2026, les 0,05 $/min correspondent à l'hébergement de la plateforme. La transcription, le modèle de langage et la synthèse vocale sont refacturés en plus, au coût fournisseur, avec des fourchettes distinctes affichées pour chacun. Le transport téléphonique constitue encore une ligne séparée.

Même logique chez Retell : l'infrastructure voix y est affichée à 0,055 $/min, à laquelle s'ajoutent la synthèse vocale, le modèle, la téléphonie, puis des options facturées elles aussi à la minute — base de connaissances, débruitage, garde-fous, suppression des données personnelles. Sur la même page, l'écart entre le modèle de langage le moins cher et le plus cher de la liste va de 0,0016 $ (GPT 5 nano) à 0,32 $ la minute en palier standard (GPT 6 Astra) : un rapport de 1 à 200, sur la même grille, pour le même produit — et jusqu'à 0,64 $, soit 1 à 400, si l'on compte le palier rapide de ce même modèle. Le choix de modèle pèse davantage sur la facture que le choix de plateforme. Chez ElevenLabs, la documentation précise explicitement que « le modèle de langage et la téléphonie sont facturés séparément ».

Le second levier, moins commenté, est la concurrence : le nombre d'appels simultanés. Vapi facture 10 $ par ligne supplémentaire et par mois au-delà du forfait, Retell 8 $. ElevenLabs applique un tarif de dépassement à 0,160 $/min, soit le double du tarif standard, quand la limite est franchie. Autrement dit, la variable déterminante n'est pas le prix de la minute moyenne, c'est le profil de votre pic d'appels. Un service client dont le volume double entre 8 h et 10 h ne paie pas le tarif affiché : il paie le tarif de son pic, ou il met ses appelants en file d'attente.

La téléphonie est un projet, pas une ligne de facture

C'est le poste le plus systématiquement sous-estimé, parce qu'il relève d'un métier — les télécoms — que les équipes projet IA ne pratiquent pas.

Trois mécanismes suffisent à comprendre l'ampleur de l'écart.

La destination change tout. Sur la grille SIP trunking de Twilio pour la France, relevée en septembre 2026, la terminaison vers les fixes démarre à 0,0147 $/min. Le mobile affiche deux tarifs sur la même ligne selon l'origine de l'appel : 0,1563 $/min en tarif standard, 0,0364 $/min « depuis l'EEE » — c'est ce second tarif qui s'applique à un trafic opéré depuis la France, soit un écart de 2,5 fois avec le fixe. Les services spéciaux, eux, montent à 0,5473 $/min : 37 fois le tarif fixe, sur la même page, pour le même produit. Un standard entrant et une campagne de rappel sortant vers des numéros surtaxés n'ont donc rien à voir budgétairement, même avec un prix plateforme identique.

Le transfert fait tourner deux compteurs. La documentation de Twilio est claire : chaque jambe d'appel est facturée séparément, et chaque jambe est arrondie à la minute supérieure. Un appel entrant transféré à un conseiller compte donc deux jambes. Ce détail a une conséquence contre-intuitive : plus votre callbot échoue souvent, plus la minute facturée coûte cher, puisque la minute de transfert s'ajoute à celles déjà consommées par le bot. Le coût unitaire se dégrade exactement dans la situation où le projet va mal.

Le raccordement à l'existant conditionne l'architecture. Selon la méthode retenue, le transfert vers un conseiller peut se faire par un passage de main complet (SIP REFER) ou en maintenant le bot dans la conférence pour continuer à transcrire — ce second choix prolonge la facturation de la plateforme pendant toute la conversation humaine. Sur les infrastructures anciennes, le média transite par des passerelles centralisées en codecs compressés, ce qui ajoute de la latence et dégrade l'audio qui parvient au modèle. Cette dégradation ne se voit pas sur une facture. Elle se voit sur le taux d'incompréhension, donc sur les reprises.

Le corpus documentaire, le poste humain que personne ne provisionne

Un callbot ne connaît pas votre politique de retour, vos délais d'astreinte ou vos conditions de garantie. Il lit ce qu'on lui donne.

Les éditeurs facturent le contenant : Retell affiche 0,005 $/min pour l'usage d'une base de connaissances et 8 $/mois par base au-delà de dix. Personne ne facture le contenu, parce que personne ne le produit à votre place.

Or ce travail est rarement technique. Il consiste à identifier les documents qui font autorité, arbitrer entre des versions qui se contredisent, dater, déprécier, structurer. Il mobilise donc les responsables métier — c'est-à-dire précisément les personnes dont le temps n'a pas été réservé dans le planning projet. La part du temps qu'un projet IA consacre à la préparation des données reste débattue, et le chiffre de 80 % souvent cité est lui-même contesté : une analyse qui retrace son origine le fait remonter à des enquêtes plus modestes — 60 % en 2016, 51 % en 2017, 73,5 % des répondants qui déclarent y consacrer au moins un quart de leur temps en 2019 — et le qualifie de statistique répétée sans base solide. Aucune de ces enquêtes, en revanche, ne décrit ce poste comme marginal.

Le mécanisme de coût est surtout récurrent, et c'est ce qui le rend redoutable. Une procédure modifiée mais non réindexée continuera de produire des réponses assurées et périmées : le système de récupération sélectionne le passage le plus proche de la question, sans disposer d'un moyen de savoir qu'un document en a remplacé un autre. La préparation documentaire n'est donc pas une tâche de lancement, c'est une charge de gouvernance permanente. Un bailleur social qui met à jour ses consignes d'astreinte deux fois par an doit provisionner deux cycles de révision par an, pas un chantier initial.

Les reprises d'erreur et la supervision se paient deux fois

Aucun callbot ne traite 100 % des appels. Les taux de résolution autonome publiés sur le marché s'étalent largement, et il faut dire d'où ils viennent : les fourchettes de 60 à 90 % que l'on croise sont publiées par des éditeurs ou des cabinets liés au secteur, pas par des tiers indépendants. Nous ne les reprenons pas à notre compte — c'est aussi pour cela que nous publions notre méthodologie de test.

Ce qui est en revanche documenté, c'est que le marché facture la supervision comme un poste à part entière. Sur la grille Retell, l'assurance qualité automatisée des conversations est affichée à 0,10 $/min après 100 minutes offertes — soit près du double du tarif de l'infrastructure voix elle-même (0,055 $/min). Quand un éditeur facture le contrôle plus cher que l'exécution, il indique où se situe la charge réelle.

À cela s'ajoute le coût humain, qui n'apparaît sur aucune grille : écoute d'échantillons d'appels, qualification des échecs, correction des consignes, traitement des appelants qui rappellent parce que le premier appel n'a rien résolu. Le bon calcul n'est pas « coût de la minute bot » mais « coût complet par demande effectivement résolue », qui additionne les minutes bot, les jambes télécom, le temps conseiller sur les appels transférés et les appels répétés. C'est aussi la seule base de comparaison honnête avec une prestation humaine, que les centres de contact français facturent couramment sous forme d'abonnement plus minute de conversation.

Après la mise en production, le coût ne s'arrête pas

Un callbot n'est pas un projet qui se termine : c'est un actif qui dérive.

Trois déclencheurs de régression sont identifiés par Vapi lui-même, qui les résume dans sa note sur les évaluations : une modification de consigne, l'ajout d'un outil, un changement de modèle. Et la formulation de la défaillance mérite d'être citée telle quelle : « Rien n'a planté. Rien n'a alerté. Les conversions ont simplement baissé en silence. » La conclusion que l'éditeur en tire est directe : « Le code a des tests. Les prompts et les outils, non. C'est là qu'est le trou. »

Le changement de modèle, surtout, ne relève pas de votre calendrier. La politique de dépréciation d'OpenAI prévoit un préavis d'au moins six mois pour les modèles généralement disponibles, au moins trois mois pour leurs variantes, et beaucoup moins pour les modèles en avant-première — la migration, elle, suppose une modification applicative. Vous héritez donc d'une campagne de re-test imposée de l'extérieur, sans valeur métier ajoutée, à une fréquence que vous ne maîtrisez pas. Même logique pour les intégrations : chaque évolution d'API côté CRM ou ERP déclenche une reprise.

La conformité relève de la même catégorie. Depuis le 2 août 2026, l'article 50 du règlement européen sur l'IA impose d'informer la personne qu'elle interagit avec un système d'IA, au plus tard lors de la première interaction, de manière claire et distinguable ; la FAQ de la Commission rappelle que les sanctions peuvent atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial. Pour un callbot, cette information se prononce — donc elle consomme des secondes facturées sur chaque appel, à la plateforme comme à l'opérateur. C'est un coût de conformité qui atterrit littéralement sur la facture d'usage.

En France, le sortant vers les particuliers obéit en outre à une contrainte plus structurante que budgétaire : depuis le 11 août 2026, l'article L223-1 du code de la consommation, réécrit par l'article 13 de la loi n° 2025-594 du 30 juin 2025, interdit le démarchage téléphonique sans consentement préalable, libre, spécifique, éclairé, univoque et révocable, la preuve incombant au professionnel. Un projet de callbot sortant B2C sans base de consentement traçable n'est pas un projet moins cher : c'est un projet sans marché adressable. Côté enregistrement des appels, la CNIL encadre l'information des personnes, la limitation de la durée de conservation et les habilitations d'accès. Nous détaillons ces obligations dans Réglementation & confiance.

L'objection la plus sérieuse : « ces coûts existent dans tout projet SI »

Un intégrateur ou un éditeur peut répondre que rien de tout cela n'est propre au callbot. Intégration, qualité des données, supervision, maintenance : ces postes pèsent sur n'importe quel projet de système d'information, et les pointer du doigt ici relèverait d'un procès sélectif. Il ajoutera, à juste titre, qu'un périmètre étroit — prise de rendez-vous, statut de commande, qualification d'appel avant transfert — les réduit considérablement.

L'objection est fondée, et la recommandation qu'elle contient est la bonne. Elle ne dissout pourtant pas la thèse, pour trois raisons.

D'abord, un périmètre étroit supprime certains postes, pas tous. La préparation documentaire s'effondre presque entièrement sur un bot qui donne des horaires. Elle ne supprime ni le raccordement téléphonique, ni les obligations de transparence, ni la migration imposée par le retrait d'un modèle : ce dernier s'applique de la même façon à un agent de trois intentions et à un agent de trois cents.

Ensuite, la différence avec un projet classique est de nature. Le composant central est non déterministe, et il est fourni par un tiers qui le retire selon son propre calendrier. Un connecteur comptable ne change pas de comportement parce qu'on a reformulé une phrase ; un modèle de langage, si.

Enfin, l'argument « ces coûts existent partout » n'est pas rassurant, il est corroborant. Quand Gartner prévoit, dans un communiqué du 25 juin 2025, que plus de 40 % des projets d'IA agentique seront abandonnés d'ici fin 2027, les motifs avancés sont l'escalade des coûts, l'absence de valeur métier démontrée et l'insuffisance des contrôles de risque — pas l'échec technique de la brique conversationnelle.

La bonne question n'est donc pas « combien coûte la minute », mais « combien de ces postes mon cas d'usage me permet-il d'éviter ».

Ce qu'il faut demander avant de signer

Quatre questions suffisent à faire apparaître l'écart entre grille et budget : quelles minutes sont facturées pendant un transfert et par qui ; quel est le tarif applicable à mon pic d'appels simultanés, pas à ma moyenne ; qui produit et met à jour le corpus documentaire, avec quel budget-temps métier ; et que se passe-t-il, contractuellement, le jour où le modèle utilisé est retiré.

Aucun éditeur ne publie aujourd'hui de coût complet par demande résolue. Tant que l'unité facturée restera la minute et non la résolution, l'écart entre la grille et le budget réel ne sera pas un défaut de transparence : ce sera une propriété du modèle économique. Reste à savoir si un acheteur suffisamment gros finira par exiger l'autre métrique.


Transparence : Call-bot.ai est édité par Nehos Groupe - KBC SOLUTIONS, qui conçoit et intègre des solutions conversationnelles pour des entreprises, et se trouve donc économiquement concerné par les postes d'intégration décrits ici. Nous ne vendons aucune des plateformes citées et ne percevons aucune rémunération de leur part. Les tarifs mentionnés ont été relevés sur les pages publiques des éditeurs en septembre 2026 et sont susceptibles d'évoluer.