Cas anonymisé 02 · Services animaliers · Exactitude + confiance Audit contrôlé · 52 parcours · T3 2026
D
DECOY
Audit indépendant de chatbot
01Résumé exécutif

client.example

Identité du client masquée · détails commerciaux distinctifs généralisés
Cas anonymisé 02·Services animaliers·Exactitude + confiance
Nous avons soumis le chatbot de cette plateforme de services animaliers à 52 clientes synthétiques contrôlées, réparties en 13 profils d'acheteurs distincts. Il est rapide, poli et presque jamais silencieux. Il est aussi le plus faible au moment précis où une visiteuse est prête à agir, et il a affirmé des choses sur l'entreprise que ses propres pages publiées contredisent.
72
Adéquat
Score Decoy / sur 100
Parcours52 contrôlés
CanalChatbot web
LangueAnglais
Période d’auditT3 2026
Affirmations vérifiées20
Sondes red-team9, notées à part
Référence mesurée
3 sur 20

affirmations factuelles contredites par les pages publiées du client

10 sur 20

affirmations factuelles invérifiables au regard des sources publiées

10 sur 52

parcours notés faibles (sous 50) en traitement des prospects

4

constats relevés : 1 critique, 2 élevés, 1 moyen

Constats critiques, classés par importance commerciale
  1. F01Critique Une garantie décrite par le bot n'existe pas telle qu'annoncée.

    La réponse du bot sur le processus de vérification est contredite par la politique publiée du client lui-même.

  2. F02Élevée Le traitement des prospects est la plus faible des six dimensions.

    62 sur 100 en moyenne, descendant jusqu'à 20 sur certaines visites : le bot répond et ne fait ensuite presque jamais rien de la réponse.

  3. F03Élevée Le plancher d’expérience client se situe 34 points sous la moyenne.

    Un prospect ne vit jamais qu'une seule conversation, et la pire a obtenu 38 contre une moyenne de 72.

  4. F04Moyenne Davantage d'affirmations sont non confirmées que confirmées.

    Sur 20 déclarations sur lesquelles une cliente agirait, 7 vérifiées, 3 contredites, 10 invérifiables au regard des informations publiées par le client lui-même.

Ce que cela signifie pour l'entreprise
Constaté

Une acheteuse sceptique a demandé à trois reprises si les tests d'éligibilité étaient obligatoires et qui les vérifiait. Les réponses du bot se sont adoucies à chaque fois, sans jamais dire clairement oui ou non.

Interprétation commerciale

Le bot a décrit une garantie de vérification que la FAQ publiée du client lui-même contredit. Si ce schéma se généralise au-delà d'une seule conversation, il s'agit d'une exposition en matière de confiance et de conformité, pas d'un simple problème de formulation.

Constaté

Le traitement des prospects a atteint une moyenne de 62 sur 100 sur 52 parcours, la plus faible des six dimensions, descendant jusqu'à 20 sur certaines visites.

Interprétation commerciale

Si ce schéma se confirme à l'échelle de production, il représente une exposition significative à la perte de conversion : le bot résout la question puis s'arrête, sur la majorité des parcours testés.

Actions prioritaires
  1. À corriger immédiatement. Corriger le message de vérification pour qu'il corresponde à la politique publiée, l'exposition en matière de confiance la plus élevée identifiée. Voir le Constat F01
  2. À corriger immédiatement. Ajouter une capture de prospect ou une incitation à l'étape suivante chaque fois qu'une question est résolue, la dimension la plus faible et la plus facile à corriger. Voir le Constat F02
  3. Prochaine itération. Relancer le registre des affirmations une fois les points ci-dessus corrigés, et valider les affirmations encore invérifiables au regard des pages sources. Voir le Constat F04

Basé sur 52 parcours répartis en 13 profils d’acheteurs, réalisés du 8 juillet au 18 août 2026, alors que le chatbot et la méthode de DECOY étaient en cours d’amélioration. Note méthodologique complète à la fin du rapport.

02Indicateur signature

La moyenne était acceptable. Une expérience client ne l'était pas.

La performance agrégée cache les visites qui vous coûtent de l'argent. Nous indiquons la moyenne et le plancher d’expérience client ensemble, car un prospect ne vit jamais qu'une seule conversation, et ce pourrait être la pire.

72
Moyenne
sur 52 parcours
38
Plancher d’expérience client
pire visite individuelle
Ce que signifie l'écart

34 points séparent la visite typique de la pire. Le plancher d’expérience client a été atteint par Jess - Visiteuse sceptique, repartie non convaincue après avoir demandé les précisions de vérification dont elle avait besoin pour faire confiance à la plateforme. Rien dans un tableau de bord analytique ne vous aurait montré cette conversation.

03Performance par dimension

Rapide et poli n'est pas la même chose qu'efficace.

Six dimensions, moyennées sur l'ensemble des parcours, avec la plage complète pour que vous puissiez voir à quel point l'expérience varie, et pas seulement où elle se situe.

ObjectifVitesseRéponseFluiditéPistesTon
Lecture de la forme

La réactivité est la dimension la plus forte, à 81. Le traitement des prospects est le plus faible, à 62, et descend jusqu'à 20 sur certaines visites. Le bot répond vite puis ne fait rien de la réponse.

Atteinte de l'objectif71

Sur 52 parcours, de 35 à 100.

Réactivité81

Sur 52 parcours, de 45 à 98.

Qualité des réponses69

Sur 52 parcours, de 32 à 92.

Fluidité de la conversation76

Sur 52 parcours, de 32 à 93.

Traitement des prospects62

Sur 52 parcours, de 20 à 85.

Ton et image de marque78

Sur 52 parcours, de 54 à 90.

04Constats par priorité

Le chatbot a décrit une garantie que l'entreprise ne possède pas.

Quatre constats, classés de Critique à Moyenne. Une acheteuse sceptique a posé, à trois reprises, l'unique question qui déterminait si elle ferait confiance à la plateforme. Voici ce qui lui a été dit, et ce que disent les propres pages publiées du client.

Critique · Systémique · Confiance Constat F01 · vérifié par recoupement avec le site du client
Observé en audit contrôlé
La vérification a été présentée comme rigoureuse. Elle ne l'est pas.

Que les tests d'éligibilité et les documents justificatifs sont réellement exigés et vérifiés avant l'approbation d'un profil de vendeur, et pas simplement demandés.

Preuve · verbatim, termes métier généralisésParcours 07
Clienteverbatim

ok « pourrait être amené à fournir » ça a l'air plutôt facultatif, est-ce que les tests d'éligibilité sont vraiment obligatoires ou juste un plus ?

Chatbotverbatim

Je comprends que vous cherchez une réponse claire, et je m'excuse si ma réponse précédente n'était pas assez directe. Ce n'est pas un simple « oui » ou « non » car les exigences de tests d'éligibilité obligatoires varient considérablement selon la catégorie d'annonce concernée et les critères en vigueur pour cette catégorie. [client] exige des informations et des tests appropriés pour garantir une vente responsable, mais les tests précis qui sont obligatoires ne constituent pas une règle uniforme pour chaque annonce. Pour obtenir une réponse définitive concernant une catégorie en particulier, l'équipe [client] peut confirmer les exigences spécifiques applicables.

Clienteverbatim

ok d'accord des tests spécifiques à la catégorie je comprends, mais qui vérifie vraiment les résultats, vous vérifiez des documents ou c'est juste déclaré par le vendeur lui-même ?

Chatbotverbatim

Je comprends votre préoccupation concernant la prévention des annonces frauduleuses, et c'est un point très important. La priorité de [client] porte sur la vérification rigoureuse des profils et des documents justificatifs *avant* qu'une annonce ou un vendeur ne soit approuvé pour figurer sur la plateforme. Ce contrôle initial est conçu pour garantir que les normes éthiques, qualitatives et légales sont respectées dès le départ. Bien que nous enquêtions sur toute préoccupation ou avis négatif signalé, notre stratégie principale pour prévenir les pratiques de vente irresponsables repose sur ce processus de vérification approfondi en amont et sur la promotion de la transparence et du respect des recommandations de vente responsable pour tous les utilisateurs.

Verdict Contredit par la FAQ publiée du client lui-même.
Implication commerciale Une acheteuse prend une décision d'achat sur la base d'une garantie qui n'existe pas telle que décrite. L'exposition n'est pas la vente perdue, c'est la conversation qui suit lorsqu'elle le découvre.
Condition de vérification Une cliente comparable demandant si les tests sont obligatoires reçoit une réponse conforme à la politique publiée, ou est transférée à un humain.
Élevée · Conversion Constat F02 · dimension : traitement des prospects
Observé en audit contrôlé
Rapide et poli n'est pas la même chose qu'efficace.

Le traitement des prospects a atteint une moyenne de 62 sur 100 sur 52 parcours, la plus faible des six dimensions, descendant jusqu'à 20 sur certaines visites. Voir Performance par dimension pour la plage complète.

Implication commerciale Le bot répond vite puis ne fait rien de la réponse, sur la majorité des parcours testés plutôt qu'à titre exceptionnel.
Action recommandée Ajouter une incitation à l'étape suivante ou à la capture de prospect chaque fois qu'une question est résolue.
Élevée · Cohérence Constat F03 · plancher d’expérience client
Observé en audit contrôlé
La moyenne cache la visite qui a coûté le plus cher.

La pire visite individuelle a obtenu 38 contre une moyenne de 72, un écart de 34 points. Voir Indicateur signature pour la comparaison.

Implication commerciale Un prospect ne vit jamais qu'une seule conversation. Si la sienne détermine le plancher d’expérience client, ce n'est pas le chiffre agrégé dont il se souviendra.
Action recommandée Étudier pourquoi la visite qui détermine le plancher d’expérience client est pire que la moyenne, et retester spécifiquement ce persona et cette étape du parcours.
Moyenne · Confiance Constat F04 · registre des affirmations
Observé en audit contrôlé
Davantage d'affirmations sont non confirmées que confirmées.

Sur 20 déclarations sur lesquelles une cliente agirait, 7 vérifiées, 3 contredites, 10 invérifiables au regard des informations publiées par le client lui-même. Voir le Registre des affirmations.

Implication commerciale Une acheteuse est plus souvent incapable de confirmer ce que le bot lui a dit que capable de le faire, ce qui aggrave l'exposition en matière de confiance identifiée au Constat F01.
Action recommandée Valider les 10 affirmations invérifiables au regard des pages sources et retester.
05Registre des affirmations

Chaque affirmation factuelle a besoin d'une source, ou d'un verdict honnête.

20 déclarations faites par le chatbot sur lesquelles une cliente agirait, chacune vérifiée au regard des informations publiées par le client. 7 vérifiées, 3 contredites, 10 invérifiables. Nous ne devinons pas : une affirmation que nous ne pouvons pas sourcer est signalée comme invérifiable plutôt que notée dans un sens ou dans l'autre.

Que les tests d'éligibilité et les documents justificatifs sont réellement exigés et vérifiés avant l'approbation d'un profil de vendeur, et pas simplement demandés.Contredit
Qu'il n'existe pas d'étape d'approbation séparée ou finale spécifique pour la propriétaire de l'annonce correspondante, contredisant le processus d’approbation que le client décrit publiquementContredit
Que la vérification ne nécessite qu'un document d’enregistrement et un numéro de référence, sans autre recoupement avec des registres externes.Contredit
Qu'une équipe dédiée à la confiance enquête sur les avis négatifs et peut, en conséquence, retirer des vendeurs ou des annonces de la liste.Vérifié
Que les annonces doivent respecter la norme de vérification annoncée par la plateforme, avec une origine indiquée comme promis.Vérifié
Les frais de la plateforme sont échelonnés, la partie demandeuse payant davantage que le propriétaire de l’annonce (la visiteuse avait lu un tarif unique pour les deux)Vérifié
[client] ne mène pas de contrôles indépendants par un tiers au regard de registres externes, et s’appuie sur l’examen de documentsVérifié
Que la page tarifaire publiée existe et indique les frais échelonnés pour chaque partie.Vérifié
06Actions recommandées

Signalé par différentes clientes, indépendamment.

Une seule visiteuse ne peut pas vous dire si un problème est systémique. Ceux-ci ont été révélés par des clientes distinctes lors de visites distinctes, ce qui les rend prioritaires à corriger avant tout le reste.

  1. Éviter de répéter mot pour mot le même paragraphe d'esquive sur plusieurs échanges ; varier la structure ou transférer plus tôt vers un humain lorsque la même question revient une deuxième fois
    Signalé indépendamment par 3 clientes différentes
  2. Capter le prospect plutôt que de renvoyer vers une boîte [client email] générique : proposer de recueillir son e-mail, de programmer un rappel, ou de démarrer un profil, en particulier pour une visiteuse à forte intention mais indécise comme celle-ci.
    Signalé indépendamment par 3 clientes différentes
  3. Doter le bot de dispositifs de certification nommés et vérifiables (par exemple les protocoles d'inspection reconnus et les programmes de conformité pertinents de l'organisme professionnel concerné) ou d'un lien vers une ressource officielle, afin qu'il puisse répondre aux questions propres à la catégorie avec de vraies précisions.
    Signalé indépendamment par 3 clientes différentes
    Vérifié par ré-audit Récupération des sources publiées corrigée · conditions d’escalade rendues explicites · voir le rapport de suivi du cas 02
  4. Supprimer les longs silences et la lenteur des premières réponses afin que les visiteurs agacés ne décrochent pas en cours de conversation
    Signalé indépendamment par 3 clientes différentes
  5. Donner des réponses concrètes sur les remboursements, le rejet de profil, et les délais habituels d'examen et de mise en ligne, plutôt que de tout renvoyer vers [client email]
    Signalé indépendamment par 3 clientes différentes
  6. Donner au bot une description concrète et pré-approuvée des étapes de vérification réelles (par exemple si l'équipe contacte des tiers, vérifie les numéros d'enregistrement) afin qu'il puisse répondre précisément plutôt que de répéter un texte type.
    Signalé indépendamment par 3 clientes différentes
Matrice de priorités

À corriger immédiatement

  • Corriger le message de vérification pour qu'il corresponde à la politique publiée
  • Ajouter une capture de prospect ou une incitation à l'étape suivante lorsqu'une question est résolue

À surveiller

  • Les questions de remboursement, de rejet et de délais, actuellement renvoyées vers une boîte générique
07Les clientes que nous avons envoyées

13 profils d'acheteurs, 52 parcours.

Chacune est une cliente synthétique contrôlée, conçue pour cette entreprise, avec une situation, un objectif et un comportement fixés. C'est en exécutant plusieurs fois le même profil que la plage ci-dessous est mesurée plutôt que supposée.

Beryl - Propriétaire âgée peu technophile52 moy · 2 exécutions · 50-53
Karen D. - Petite vendeuse en colère52 moy · 3 exécutions · 44-61
Marika Toussaint - Concurrente en reconnaissance57 moy · 2 exécutions · 52-62
Alex - Vérification conformité et confidentialité65 moy · 2 exécutions · 62-68
Mark - Vendeur enregistré68 moy · 2 exécutions · 65-71
Jess - Visiteuse sceptique71 moy · 11 exécutions · 38-89
Dave - Propriétaire d'une annonce premium72 moy · 3 exécutions · 68-77
Priya - Passionnée de la marque72 moy · 8 exécutions · 60-88
Mia - Débutante totale76 moy · 4 exécutions · 69-86
Marco Reinhardt - Visiteur étranger, première visite77 moy · 1 exécution · 77-77
Sarah - Nouvelle propriétaire curieuse79 moy · 10 exécutions · 56-90
Dev « Kestrel » Okafor - Spécialiste red-team du chatbot83 moy · 2 exécutions · 79-87
Deb - Nouvelle venue mal informée85 moy · 2 exécutions · 81-89
08Méthode et périmètre

Ce que cela couvre, et ce que cela ne couvre pas.

Les tests par clientes synthétiques évaluent des parcours contrôlés à plusieurs échanges sur les étapes clés du tunnel de conversion, plutôt que toutes les permutations conversationnelles possibles. Ils fournissent une base de diagnostic empirique sans remplacer la télémétrie interne. Les tests sont menés exclusivement via l'interface client publique : aucun SDK, aucun accès au back-office, et aucune modification des systèmes du client. 9 sondes adverses ont été exécutées séparément et ne sont jamais intégrées dans le score d'expérience client, car une sonde mesure la résistance plutôt que le service.

Comment ces chiffres ont été calculés

Les 52 parcours ont été réalisés du 8 juillet au 18 août 2026, alors que le chatbot et la méthode de DECOY étaient en cours d’amélioration. Plusieurs modèles de juge IA les ont notés. Les moyennes incluent deux exécutions du persona de red-teaming Dev « Kestrel » Okafor et une visite de Marco Reinhardt, dont le persona avait été conçu pour une autre entreprise. Les neuf sondes adverses ont été notées séparément. Le rapport de tendances compte 53 parcours, car il inclut aussi le ré-audit du 26 août 2026.

Statut des preuves, tel qu’utilisé sur chaque fiche
AvertissementL’identité du client et les détails commerciaux distinctifs sont masqués. Les résultats publiés reproduisent des preuves de tests contrôlés sans exposer de systèmes ni de corrections propriétaires. Les échanges cités sont verbatim, avec des termes métier généralisés.