Comment la démonstration a été fabriquée
Vingt secondes de film 3D piloté par le défilement, 600 images calculées dans un navigateur, zéro licence payante. Le détail de la fabrication et les deux pièges.
Lire l'articleUn modèle de langage produit toujours une réponse, même quand il n'en a aucune. Comment nous fabriquons le refus, et pourquoi c'est la partie la plus utile du travail.

Un agent d'intelligence artificielle sait toujours produire une réponse, et c'est de là que viennent la plupart des ennuis.
Demandez à un modèle de langage une disponibilité, un tarif, un article de loi ou le nom d'un contact : il vous donnera quelque chose. Le texte sera bien construit, dans le bon ton, avec le vocabulaire du métier. Il aura l'air d'une réponse. Il n'aura aucun lien avec la réalité, et rien dans sa formulation ne permettra à votre client de s'en rendre compte.
Une réponse plausible et fausse, envoyée à un client par un agent qui porte votre nom, coûte plus cher que dix silences.
Chez OTTOM4T3, un agent qui doute passe la main. Aucun montant, aucun tarif, aucune disponibilité, aucune information sur l'entreprise ne sort de nulle part. Quand la question dépasse ce qu'il a le droit de savoir, il prend un message, le transmet, et il le dit à son interlocuteur.
Formulé comme ça, c'est une évidence. En pratique, c'est la partie la plus longue du travail, parce qu'elle va contre la pente naturelle de l'outil. Un modèle est entraîné à être utile et coopératif ; refuser, pour lui, c'est mal faire son travail. Il faut donc construire le refus au lieu d'espérer qu'il vienne tout seul.
Trois mécanismes, du plus solide au plus fragile.
On coupe l'accès plutôt que d'interdire. Le moyen le plus sûr d'empêcher un agent d'inventer un tarif est de ne jamais lui donner de tarif. Notre agent vocal en mode site ne connaît aucun prix, donc il ne peut pas en donner un, même à quelqu'un qui insiste, même à quelqu'un qui essaie de le piéger. C'est une propriété du système, pas une bonne intention.
On fait chercher au lieu de faire deviner. Pour tout ce qui existe vraiment quelque part, l'agent va le lire au moment de la question au lieu de puiser dans sa mémoire. Les créneaux libres sont lus dans l'agenda réel à chaque appel, les informations de l'entreprise sont relues à chaque appel. Un agent qui va chercher peut se tromper si la source est fausse, mais il ne peut pas inventer.
On écrit les cas de sortie, un par un. Urgence, litige, question technique pointue, demande hors métier : chacun a sa consigne, avec la phrase exacte à dire et ce qu'il faut faire ensuite. Ce troisième mécanisme repose sur l'obéissance du modèle, donc il est le plus fragile, et nous ne l'utilisons jamais seul pour protéger quelque chose d'important.
C'est l'erreur que nous avons faite, et elle mérite d'être racontée parce qu'elle est invisible.
Écrire dans les consignes d'un agent « dans le doute, abstiens-toi » paraît prudent. Le résultat est un agent qui s'abstient sur tout, y compris sur les questions qu'il sait traiter, parce que le doute est son état permanent. Le client ne voit pas un garde-fou qui fonctionne, il voit un agent inutile qui répond « je vais faire suivre » à des questions triviales.
Un bon garde-fou se déclenche sur des situations précises, pas sur des mots isolés. Et il doit être testé dans les deux sens : il refuse bien ce qu'il doit refuser, et il accepte bien ce qu'il doit accepter. Tester seulement le premier sens donne un agent muet qui a l'air sûr.
Le conseiller fiscal de Jordan, le frontalier, répond à des questions de fiscalité franco-suisse. Ses réponses ont été soumises à un expert du domaine avant la mise en ligne, sur un jeu de cas réels. Il refuse de répondre dès que la question sort du périmètre vérifié, et il le dit clairement au lieu de tenter une réponse générale.
La réceptionniste vocale ne propose aucun créneau qu'elle n'ait vérifié dans l'agenda du client. Quand elle ne comprend pas, elle prend un message avec le nom et le numéro plutôt que d'improviser. Elle a été testée en appel réel avant d'être ouverte.
Les chaînes d'automatisation suivent toutes le même dessin : déclencheur, analyse, décision, exécution. La dernière étape prépare presque toujours au lieu d'envoyer, et le brouillon attend une validation humaine. Chaque étape est visible dans l'outil, chaque chaîne a son interrupteur, et c'est le client qui l'actionne.
Un agent qui invente est découvert. Pas tout de suite, mais toujours : un client se déplace pour un rendez-vous qui n'existe pas, un prix annoncé n'est pas tenu, une information fausse est répétée devant quelqu'un qui sait. Ce jour-là, ce n'est pas l'agent qui perd sa crédibilité, c'est l'entreprise qui l'a mis en ligne.
Un agent qui passe la main est un agent que vous pouvez laisser toucher à vos clients. C'est la ligne que nous nous fixons, et elle se décide au cadrage, avant le devis.
Vingt secondes de film 3D piloté par le défilement, 600 images calculées dans un navigateur, zéro licence payante. Le détail de la fabrication et les deux pièges.
Lire l'articleCe que fait l'agent vocal que nous livrons : il lit l'agenda réel, écarte les créneaux pris, pose le rendez-vous, prévient le patron. Et ce qu'il refuse de faire.
Lire l'articleQuinze minutes suffisent pour savoir si nous sommes les bonnes personnes. Si nous ne le sommes pas, nous vous le dirons pendant l'appel.