
L'échec confiant est le genre coûteux
N'importe quel modèle transformera de la prose en JSON. Ce n'est pas le problème qui vaut d'être résolu.
Le problème survient quand le texte ne contient pas le champ. Un modèle à qui l'on demande une date de livraison en produira une qui a l'air d'une vraie réponse. Une valeur inventée qui entre dans une base de données coûte plus que cinquante lignes traitées à la main, parce que les cinquante sont visibles et celle-là ne l'est pas.
L'extraction doit pouvoir ne rien dire. Chaque champ est soit une valeur trouvée dans la source, soit un marqueur vide explicite. La structure est imposée après la génération plutôt que d'être crue.
La sortie est deux tableaux, pas un. Les lignes qui se sont analysées proprement, et celles qui ne l'ont pas fait, chacune portant le texte d'origine pour qu'une personne voie ce que l'extraction regardait. Un seul tableau avec des trous silencieux est le résultat à éviter.
Comment l'ActionFlow s'exécute sur le canevas
Le texte peut arriver de trois façons : collé dans Start, téléversé via Document Upload, ou tiré d'un PDF par PDF4me.
Un nœud Generate Object fait l'extraction contre un schéma que vous définissez. Définir la forme d'abord, c'est le point : le modèle remplit une structure plutôt que d'en inventer une, et tout champ non étayé par la source revient vide au lieu d'imaginé.
Un nœud Validate impose les types et les champs requis indépendamment du modèle. Cette séparation compte. L'étape de génération est priée d'être honnête. L'étape de validation ne s'y fie pas.
Un nœud Filter scinde le résultat. Les lignes propres continuent vers leur destination : Google Sheets, Airtable, PostgreSQL, ou un nœud Create Excel quand un fichier est nécessaire. Les lignes rejetées vont vers une feuille ou une table séparée, avec le texte d'origine joint et le champ en échec nommé.
Quand la source est longue et qu'une seule section est pertinente, un nœud Extract Data se place avant la génération. Cela garde le nombre de tokens bas et l'extraction ciblée.
Parce que le nombre de lignes est visible des deux côtés, le flux indique sa propre exactitude dans le temps. Un taux de rejet qui monte signifie en général que le format d'entrée a changé, pas que le modèle a empiré.
Nœuds utilisés par cet ActionFlow
- Start : reçoit le texte collé ou transmis. Document Upload (Data) prend un fichier à la place.
- PDF4me (Data) : extrait le contenu quand la source est un PDF.
- Extract Data (Data) : resserre une source longue à la section pertinente avant la génération.
- Generate Object (AI Core) : remplit votre schéma, en renvoyant vide pour tout ce que la source n'étaye pas.
- Validate (Data) : impose les types et les champs requis indépendamment du modèle.
- Filter (Data) : sépare les lignes propres des rejetées.
- Google Sheets (Integration) : reçoit les lignes propres. Airtable, PostgreSQL, MySQL et MongoDB occupent le même emplacement.
- Create Excel (Data) : produit un fichier quand quelqu'un en a besoin plutôt qu'un tableau.
Questions fréquentes
Newsletter
Recevoir les mises à jour produit
Nouveaux nœuds, agents et notes produit. Nous n'envoyons un e-mail que lorsqu'il vaut la peine de l'ouvrir.