Après le guide complet de l'IA intégrée d'Odoo 20, restait la question que tout le monde pose : qu'est-ce que ça vaut, et qu'est-ce que ça coûte ? J'ai posé 19 questions à l'agent Odoo AI sur une base de démonstration, en mesurant pour chacune le nombre d'appels au modèle, la durée, les crédits consommés et la justesse de la réponse, vérifiée en base. Voici les chiffres, tels quels.
Le benchmark a été joué le 8 octobre 2026 sur une instance Odoo 20.0 Enterprise hébergée par akolio, chargée des données de démonstration natives : 3 sociétés, 36 devis, 44 opportunités, 133 tâches, 29 tickets, 527 lignes de feuilles de temps, 4 agents et 35 outils livrés d'origine. L'agent interrogé est celui que tout utilisateur trouve dans la barre du haut, « Odoo AI », avec ses réglages par défaut.
1. La méthode, en trois règles
Un benchmark d'IA ne vaut que par sa méthode, alors la voici.
Une conversation neuve par question. Chaque question est posée dans un fil vierge, par les mêmes routes que le bouton Ask AI de l'interface, afin que l'agent n'hérite d'aucun contexte de la question précédente.
Le coût est lu sur le compteur, pas estimé. Odoo AI se paie en crédits achetés chez Odoo, un crédit valant un euro sans dégressivité au palier que j'ai acheté. Le solde du compte est relevé avant et après chaque question : la différence est le prix exact de la réponse.
La justesse est tranchée en base, pas à l'œil. Pour chaque question, le chiffre attendu a été relu par une requête SQL le jour même. Une réponse qui « a l'air juste » ne compte pas ; une réponse qui contredit la base est comptée fausse, même si elle est bien rédigée.
Les 19 questions couvrent six familles : lecture simple d'un chiffre, agrégation sur plusieurs objets, analyse comptable, question multi-sociétés, question piège, question hors base, et trois demandes qui écrivent dans l'ERP.
2. Ce que ça coûte
Seize questions de lecture ont consommé 4,95 crédits, soit 4,95 euros, pour 120 appels au modèle et 13 minutes 14 secondes de temps cumulé.
| Mesure | Valeur |
|---|---|
| Coût moyen d'un appel au modèle | 0,041 € |
| Coût moyen d'une question | 0,31 € |
| Question la moins chère | 0,02 € (une réponse en un seul tour, sans outil) |
| Question la plus chère | 1,18 € (le chiffre d'affaires par société) |
| Durée d'une réponse | de 9 à 104 secondes, 49 en moyenne |
Le détail par famille dit où va l'argent.
| Famille | Tours d'agent en moyenne | Crédits par question | Durée |
|---|---|---|---|
| Lecture simple | 6,2 | 0,13 à 0,22 | 26 à 49 s |
| Agrégation | 7,0 | 0,08 à 0,63 | 27 à 80 s |
| Analyse comptable | 9,0 | 0,21 à 0,56 | 48 à 104 s |
| Multi-sociétés | 14,0 | 1,18 | 99 s |
| Piège | 5,0 | 0,03 à 0,16 | 14 à 35 s |
| Hors base | 8,0 | 0,02 à 0,53 | 9 à 71 s |
Première surprise : une question « simple » n'est pas bon marché. « Combien de tickets d'assistance sont ouverts ? » a demandé 6 tours et 0,13 euro. L'agent ne devine pas où chercher : il explore le modèle, lit les étapes, puis compte. C'est ce qui le rend utilisable sans paramétrage, et c'est ce qui se paie.
Seconde surprise : le prix ne suit pas le nombre de tours mais le volume de texte échangé. La question du chiffre d'affaires par société a coûté 1,18 euro en 14 tours parce que l'agent a ouvert le compte de résultat et déplié ses lignes pour vérifier. L'analyse du compte de résultat proprement dite, en 9 tours, a coûté 0,34 euro. Un rapport comptable déplié pèse lourd dans la facture.
3. Ce que l'agent a trouvé juste
Douze réponses sur seize sont exactes au centime ou à l'unité près.
Le chiffre d'affaires commandé : 28 commandes confirmées, 519 511,13 dollars TTC et 459 772,50 hors taxes, les deux montants corrects. Les commandes d'achat en brouillon : 8 commandes, 196 667,03 dollars, ventilées par fournisseur, avec en prime le total si l'on ajoute les demandes envoyées. Les feuilles de temps de septembre : le classement des employés, 71, 57 et 34 heures, est identique à la requête SQL, projet par projet.
La comparaison du facturé et du commandé mérite qu'on s'y arrête. L'agent a distingué les factures validées, les avoirs comptabilisés, le brouillon en attente, puis expliqué l'écart commande par commande : telle commande prête à facturer pour 252 710 dollars chez tel client. C'est le genre de réponse qui remplace vingt minutes de filtres.
Le contrôle des avoirs clients a donné le résultat le plus intéressant. Demande : vérifier que chaque avoir correspond à une facture d'origine. Réponse : aucun des quatre avoirs n'est rattaché à une facture, aucun n'est lettré, et l'un d'eux est daté un mois avant la facture qu'il semble rembourser. C'est exact, c'est une particularité des données de démonstration, et l'agent l'a vue sans qu'on lui souffle où regarder.
Sur l'analyse du compte de résultat, l'agent a produit le tableau complet, exercice contre exercice précédent, revenu 85 344 dollars, charges 10 653,27, résultat 74 690,73, tous conformes au rapport comptable d'Odoo.
4. Ce qu'il a raté, et comment
Une réponse fausse. À « combien de tickets sont encore ouverts ? », l'agent a répondu 20, soit 11 nouveaux et 9 en cours. La base en compte 23 : 13 nouveaux et 10 en cours. Trois tickets manquent à l'appel, sans que la réponse ne laisse rien paraître. Elle est propre, structurée, et fausse de 13 %. C'est la leçon principale du benchmark : la forme de la réponse ne dit rien de sa justesse, et seul un contrôle contre la donnée tranche.
Un échec du service. À « combien d'ordres de fabrication attendent encore des composants ? », la réponse a été « Oups, il semble que notre IA soit injoignable ». Le journal de l'instance montre que le service Odoo AI a renvoyé une erreur de traitement après trois tours. La question a tout de même été facturée 0,03 euro. Sur 19 questions, c'est le seul échec, et il vient du service distant, pas de l'instance.
Une réponse juste sans source. Sur la conservation des factures électroniques en France, l'agent a répondu en un seul tour, sans chercher sur le web : six ans au titre fiscal, dix ans au titre commercial, articles cités. Le fond est correct, mais rien ne permet au lecteur de le vérifier depuis la réponse. Pour ce type de question, mieux vaut un agent avec des sources documentaires attachées, qui cite ce qu'il lit.
Une réponse non vérifiable. « Quel est le stock disponible du produit le plus vendu ? » a reçu une réponse plausible et détaillée, distinguant les services des articles stockables, avec quantité en main, disponible et prévue. Je n'avais pas de chiffre attendu pour la juger, donc je ne la compte ni juste ni fausse. Un benchmark honnête garde cette case.
5. Quand l'agent doit écrire
Trois demandes modifient l'ERP : créer une opportunité, créer un devis avec trois produits, passer en Terminé toutes les tâches en retard d'un projet.
Dans les trois cas, l'agent s'est arrêté avant d'écrire et a demandé confirmation. Un contrôle en base après coup confirme qu'aucune opportunité, aucun devis et aucune tâche n'ont été créés ni modifiés. Le garde-fou décrit dans le guide tient à l'usage.
| Demande | Tours | Durée | Crédits | Ce que l'agent avait préparé |
|---|---|---|---|---|
| Créer une opportunité à 12 000 $ en étape Qualifiée | 5 | 31 s | 0,17 | la fiche complète, prête à créer |
| Terminer les tâches en retard d'un projet | 8 | 52 s | 0,41 | une seule tâche concernée, exact |
| Créer un devis avec trois produits | 13 | 109 s | 1,35 | le client n'existant pas, la création de sa fiche d'abord |
La sécurité a un prix : la préparation d'un devis a coûté 1,35 euro et près de deux minutes avant même la première question de confirmation, parce que l'agent a cherché le client, parcouru le catalogue et construit les lignes. Rien n'a été écrit, tout a été facturé.
6. Ce que ça donne pour une équipe
Au coût moyen mesuré, 0,31 euro par question, et avec le même mélange de questions, riche en analyses chiffrées :
| Profil | Questions par jour ouvré | Coût par mois, 21 jours |
|---|---|---|
| Un utilisateur occasionnel | 5 | 32 € |
| Une équipe de 5 personnes | 25 | 162 € |
| Un usage intensif, 20 personnes | 100 | 649 € |
Trois réserves avant de reporter ces chiffres sur un devis. Le mélange joué ici fait la part belle à la comptabilité et aux rapprochements, donc au haut de la fourchette ; un usage courant fait de questions courtes coûtera moins. Les champs IA et les actions serveur IA, qui tournent sur des fiches en masse sans qu'un humain pose de question, ne sont pas dans la mesure : une recomputation sur mille contacts, c'est mille appels. Et une base réelle a plus d'écritures qu'une base de démonstration ; un agent qui les parcourt enchaîne plus de tours.
7. Ce que je retiens
L'IA intégrée d'Odoo 20 répond juste dans trois cas sur quatre sur des questions de gestion ordinaires, et elle brille sur les rapprochements comptables, là où elle économise réellement du temps. Elle se trompe sans prévenir une fois sur seize, sur un simple comptage. Elle ne modifie rien sans accord, et cet accord se paie.
Avant de l'ouvrir à une équipe, trois gestes. Poser un seuil d'alerte sur le compte de crédits, pour ne pas découvrir la facture à la fin du mois. Garder le réflexe de vérifier tout chiffre qui engage, comme on le ferait avec un stagiaire brillant. Et mesurer sur ses propres données, avec ses propres questions : le protocole que j'ai utilisé est reproductible en une commande et coûte moins de dix euros.
Le guide complet de l'IA intégrée d'Odoo 20, qui décrit agents, compétences, outils et garde-fous, reste la lecture préalable : https://akol.io/blog/parcours-odoo-4/l-ia-integree-d-odoo-20-le-guide-complet-19