
Les messages vocaux sont traités en dernier parce qu'on ne peut pas les parcourir en diagonale
Vous ne pouvez pas décider d'un coup d'œil si un message vocal exige votre attention, donc il reste en attente plus longtemps qu'un message écrit d'urgence égale.
La transcription seule ne résout pas l'ordre. Elle résout le problème du parcours en diagonale, ce qui suffit à mettre le message dans la même file que le reste au lieu d'un tas à part que personne ne regarde.
Le canal de réponse est en général le même que le canal d'arrivée, et cela doit être respecté. Si quelqu'un a envoyé un message vocal sur WhatsApp, il n'attendra pas un e-mail. Changer de canal se lit comme une esquive.
L'erreur est d'envoyer sans vérifier. Les erreurs de transcription ne sont pas aléatoires. Elles tendent à porter sur les noms, les chiffres et les termes techniques, précisément ce dont une réponse a besoin.
Comment l'ActionFlow s'exécute sur le canevas
Les notes vocales arrivent par un déclencheur Webhook depuis WhatsApp ou Telegram. Un nœud Document Upload prend ensuite le fichier audio.
Le nœud Transcribe Audio le convertit. Le choix du fournisseur compte plus ici que dans la plupart des autres flux, car les messages vocaux s'enregistrent sur téléphone dans de mauvaises conditions, et une mauvaise transcription produit une réponse assurée à quelque chose qui n'a jamais été dit.
Un nœud Generate Object renvoie la demande, la question posée, et un signal de confiance de transcription qui indique à quel point une partie du message était ambiguë.
Un nœud If lit ce signal. Quand la confiance de transcription est basse, le flux saute entièrement la rédaction et envoie le cas à une personne avec l'audio, car rédiger à partir d'une mauvaise transcription fait perdre le temps du relecteur.
Pour les autres, un nœud Generate Text rédige une réponse dans le même ton que le canal d'arrivée.
Un nœud Human in the Loop sur le même canal retient le brouillon, avec la transcription et l'audio original, pour que le relecteur vérifie un nom ou un chiffre en quelques secondes.
La réponse libérée est renvoyée par le canal d'où elle venait.
Nœuds utilisés par cet ActionFlow
- Webhook (Trigger) : reçoit le message vocal. Document Upload (Data) prend le fichier audio.
- Transcribe Audio (AI Core) : le convertit. Le choix du fournisseur compte le plus sur de l'audio enregistré au téléphone.
- Generate Object (AI Core) : renvoie la demande, toute question, et un signal de confiance de transcription.
- If (Control) : saute entièrement la rédaction lorsque la transcription n'est pas fiable.
- Generate Text (AI Core) : rédige une réponse dans le registre du canal d'arrivée.
- WhatsApp (Human in the Loop) : retient le brouillon avec transcription et audio joints.
- Telegram (Communication) : envoie la réponse libérée. SMS, Slack et WhatsApp occupent le même emplacement.
Questions fréquentes
Newsletter
Recevoir les mises à jour produit
Nouveaux nœuds, agents et notes produit. Nous n'envoyons un e-mail que lorsqu'il vaut la peine de l'ouvrir.