Aller au contenu principal
IA générative

Parler est plus rapide que taper ; lire de l'oral est plus lent que lire de l'écrit

La dictée est le moyen le plus rapide de sortir une idée de votre tête et le pire moyen de la stocker. Une transcription brute conserve chaque reprise, chaque aparté, chaque « en fait, non ». Qui la lit plus tard fait l'édition qu'on a évitée au départ.

Nettoyer et structurer ont l'air d'une seule tâche mais se comportent comme deux. Un modèle à qui l'on demande les deux à la fois lâche souvent du contenu. Il décide qu'une digression est du bruit, la retire, et réorganise autour du trou. Parfois, la digression était l'idée.

Les lancer en passes séparées corrige cela. La première retire les disfluences sans changer le sens ni l'ordre. La seconde impose une structure à un texte déjà propre et peut montrer ce qui est réellement là.

Garder la transcription brute jointe au document fini ne coûte rien et tranche plus tard tout débat sur ce qui a été dit.

Comment l'ActionFlow s'exécute sur le canevas

Le fichier audio arrive via Document Upload. Transcribe Audio le convertit en texte, et le service de modèle que vous choisissez ici compte plus qu'ailleurs dans le flux. Un fournisseur de transcription réglé pour votre langue et vos conditions audio change tout en aval.

Le premier nœud Generate Text ne retire que les disfluences. Son instruction interdit de réordonner, de résumer ou de couper du contenu. La sortie devrait exprimer la même pensée clairement.

Le second nœud Generate Text structure le texte nettoyé en titres, un paragraphe d'attaque, et un ordre. Parce qu'il travaille sur une entrée propre, il ne devine pas ce qu'était un faux départ.

Un nœud Notion écrit le document fini, avec la transcription brute ajoutée en dessous comme section repliée. Google Docs occupe le même emplacement.

Quand les enregistrements varient en durée, un nœud If vaut d'être ajouté. Les notes courtes passent tout droit. Les longues routent d'abord par un nœud Extract Data pour que la passe de structuration ne traite pas une transcription de quarante minutes en un seul appel.

Les deux appels de génération rapportent leur consommation de tokens et leur coût comme sorties de nœud, c'est ainsi que vous voyez que la transcription, pas la génération, est la partie chère de ce flux.

Nœuds utilisés par cet ActionFlow

  • Document Upload (Data) : prend le fichier audio.
  • Transcribe Audio (AI Core) : convertit la parole en texte. Le choix du fournisseur compte le plus à ce nœud.
  • Generate Text (AI Core) : première passe, retire les disfluences sans changer le sens ni l'ordre.
  • Generate Text (AI Core) : seconde passe, impose titres, ordre et un paragraphe d'attaque.
  • Extract Data (Data) : resserre les très longues transcriptions avant la passe de structuration.
  • If (Control) : route les enregistrements courts et longs différemment.
  • Notion (Integration) : reçoit le document avec la transcription brute ajoutée. Google Docs occupe le même emplacement.

Questions fréquentes

Créer des workflows IA

Créez un compte gratuit, ouvrez un modèle ou une toile vide, puis lancez votre premier ActionFlow.

Newsletter

Recevoir les mises à jour produit

Nouveaux nœuds, agents et notes produit. Nous n'envoyons un e-mail que lorsqu'il vaut la peine de l'ouvrir.

Désabonnement à tout moment.