Un même message client peut contenir une question technique, une réclamation et une demande de geste commercial. Le transmettre sans distinction à un agent généraliste laisse trop de décisions implicites : quelles informations consulter, quelle équipe mobiliser et quels engagements sont autorisés ?

Un classifieur sert à attribuer une ou plusieurs catégories à une demande. Le routage utilise ce résultat pour choisir le traitement suivant. Classer une demande comme « réclamation » n’autorise pas, à lui seul, à accorder un remboursement.

Partir des responsabilités métier

Imaginons un service support fictif. Nous pourrions définir quatre traitements : réponse documentaire, incident technique, demande commerciale et revue d’un cas sensible. Une demande ambiguë devrait pouvoir rejoindre une file d’examen au lieu d’être forcée dans une catégorie peu adaptée.

Avant le choix du modèle, il faut préciser les catégories et les responsabilités. Que faire si plusieurs sujets coexistent ? Qui reprend une demande mal orientée ? Quels signaux imposent une revue ? Ces décisions relèvent du fonctionnement du service.

Choisir la complexité nécessaire

Une règle explicite peut suffire pour certains cas ; un modèle de classification ou un LLM peut aider lorsque les formulations varient. L’important est d’évaluer le résultat sur les demandes réellement reçues. Nous recommandons de comparer les options à une solution simple avant d’ajouter de la complexité.

Le jeu d’exemples devrait être annoté par les équipes, avec une explication des désaccords. Il faut garder des cas distincts pour l’évaluation, inclure les demandes rares mais importantes et éviter de tester uniquement les formulations déjà utilisées pour régler le système.

Un score ne suffit pas à décider

Un score de confiance n’est utile que si son comportement a été vérifié. Une probabilité calibrée doit correspondre aux fréquences observées sur des cas comparables. Une note que le LLM s’attribue spontanément n’est pas automatiquement une probabilité calibrée.

Le seuil de routage doit dépendre du coût des erreurs et du volume de revue acceptable. Nous déconseillons un seuil choisi parce qu’il « semble élevé ». Il faut mesurer ce qu’il laisse passer, ce qu’il bloque et les catégories pour lesquelles il fonctionne mal. Les cas sensibles peuvent nécessiter une revue indépendamment du score.

Prévoir une escalade utile

Une escalade doit transmettre la demande, les éléments trouvés, l’orientation proposée et le motif du doute. Elle doit avoir un destinataire et un délai de traitement définis. Sans cela, l’automatisation déplace simplement le travail vers une file d’attente invisible.

Dans notre exemple, une demande de documentation pourrait préparer une réponse sourcée. Une anomalie liée à la sécurité d’un équipement suivrait le processus d’incident. Une remise commerciale resterait soumise aux pouvoirs de décision de l’entreprise.

Les livrables d’un projet sérieux

Mintera propose de formaliser une carte des demandes et des décisions, construire le jeu de référence, tester le routage et concevoir les passages vers les équipes. La mesure doit couvrir chaque catégorie : bonne orientation, erreurs graves, taux de revue, délai jusqu’à résolution et coût total de traitement.

Après déploiement, de nouveaux produits et de nouvelles demandes peuvent changer la situation. Un responsable doit examiner les erreurs, actualiser les exemples et retester les réglages. Le classifieur devient alors une composante suivie du processus, avec un périmètre de décision explicite.

Cartographions les demandes et les décisions de vos équipes.