Les modules de workflow
Catalogue des modules disponibles dans l'éditeur de workflow, regroupés par catégorie, avec leurs paramètres et la structure de leurs résultats.

1. Input
Ingest Email — ingérer des emails
Ce module suppose qu'une boite mail a été configurée (voir Connexion boîte mail), ou bien que les documents envoyés sont des .msg ou .eml.
Cette étape permet de récupérer toutes les informations concernant le mail et de les conserver dans "data". Elle permet également de mettre les pièces jointes dans une collection.
Paramètres
Nom
Le nom de l'étape
Expression d'entrée
La collection d'email à traiter. files["email"] par défaut.
Taille minimale de pièce jointe (ko)
Limite minimale à une pièce jointe pour qu'elle soit prise en compte.
Taille maximale de pièce jointe (ko)
Limite maximale à une pièce jointe pour qu'elle soit prise en compte.
Ignorer pièce jointe si le nom contient
Si le nom de la pièce jointe contient le texte renseigné, alors la pièce jointe sera ignorée. Mettre le nom entre "".
Extensions acceptées pour pièce jointe
Les fichiers n'ayant pas ces extensions ne seront pas pris en compte. Par défaut : pdf, txt, html, doc, docx, ppt, pptx, tif, tiff, png, jpg, jpeg.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Collection de sortie
La collection dans laquelle seront envoyées les pièces jointes. "attachments" par défaut.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Renommer les pièces jointes en double (Rename duplicate attachments)
Si activé, les pièces jointes portant un nom identique sont automatiquement renommées pour éviter les collisions.
Structure des résultats
2. AI Agent
Documents classification agent — classification de document
Paramètres
Nom (Name)
Le nom de l'étape
Agent de classification (Classification agent)
La sélection parmi les agents de classification existants.
Per page
Permet d'avoir une classification page à page. Il peut être couplé à un module split-pdf à la suite pour déliasser un document.
Expression d'entrée (Input expression)
Le ou les fichiers à classifier. files['file'] par défaut.
Expression de l'agent de classification (Classification Agent Expr)
Sélection dynamique de l'agent de classification.
Clé de sortie (Output key)
La clé de "data" dans laquelle seront stockées les informations de ce module. classify par défaut.
Itérer sur l'entrée (Iterate over input)
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Inclure le texte OCR (Include OCR Text)
Si activé, le texte OCR du document est joint aux données renvoyées par le module.
Structure des résultats
Voir Structure des résultats de Classification
Classify Email — classification de mails
Paramètres
Nom
Le nom de l'étape
Expression d'entrée
Le mail à classifier. La valeur par défaut est : data['email']
Expression des pièces jointes
La collection des pièces jointes. La valeur par défaut est : files['attachments']
Modèle
La sélection parmi les modèles de classification de mails existants
Expression du modèle
Sélection dynamique du modèle de classification de mails.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Structure des résultats
Voir Structure des résultats de Classification
Extract — extraction
Paramètres
Nom (Name)
Le nom de l'étape
Agent d'extraction (Extraction agent)
La sélection parmi les agents d'extraction existants.
Expression d'entrée (Input expression)
Le ou les fichiers à traiter. files['file'] par défaut.
Expression de l'agent d'extraction (Extraction agent expression)
Sélection dynamique de l'agent d'extraction.
Clé de sortie (Output key)
La clé de "data" dans laquelle seront stockées les informations de ce module. extract par défaut.
Itérer sur l'entrée (Iterate over input)
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Inclure le texte OCR (Include OCR Text)
Si activé, le texte OCR du document est joint aux données renvoyées par le module.
Structure des résultats
Voir Structure des résultats d'Extraction
llm — GenAI
Nom
Le nom de l'étape
Fournisseur
Fournisseur du modèle de langue
Modèle
Version du modèle de langue
Prompt
Prompt qui sera envoyé au modèle de langue. Des variables peuvent être ajoutées en les mettant entre accolade. Exemple : Quelle est la capitale de {data.country} ?
Inclure fichier
Est-ce qu'un fichier doit être passé en plus du prompt ?
Expression d'entrée
Le ou les fichiers qui seront passés. files["file"] par défaut.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Température
Valeur entre 0 et 1. Une température proche de 0 donnera un modèle déterministe, et inversement. Certains modèles imposent une température de 1.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
3. Review
Classification Review — review de classification (vidéo-typage)
Active le vidéo-typage suite à une classification.

Paramètres
Nom
Le nom de l'étape
Contexte
Permet d'afficher des informations pendant la review
Expression d'entrée
Les données de classification à reviewer. data['classify'] par défaut.
Expression du contexte
Permet d'afficher des informations pendant la review. Le paramètre supporte des expressions dynamiques.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Expression de date d’expiration
Une fois cette date et heure dépassées, un document en attente de review sera automatiquement libéré (validé ou rejeté en fonction du paramètre Action d'expiration).
Le mécanisme de libération des documents passe 1 fois / heure.
Format de date : 2025-09-23T16:00:00+02:00
Action d'expiration
Action à prendre une fois la date d'expiration dépassée.
Structure des résultats
Voir Structure des résultats de Classification.
Email Classification Review — review de classification d'emails
Équivalent du vidéo-typage pour les emails : active la review de la classification d'un email après une étape Classify Email. Paramètres analogues à la Classification Review.
Extraction Review — review d'extraction (vidéo-codage)
Active le vidéo-codage suite à une extraction.

Paramètres
Nom
Le nom de l'étape
Expression d'entrée
Les données d'extraction à reviewer. data['extract'] par défaut.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Expression de date d’expiration
Une fois cette date et heure dépassées, un document en attente de review sera automatiquement libéré (validé ou rejeté en fonction du paramètre Action d'expiration).
Le mécanisme de libération des documents passe 1 fois / heure.
Format de date : 2025-09-23T16:00:00+02:00
Action d'expiration
Action à prendre une fois la date d'expiration dépassée.
Structure des résultats
Voir Structure des résultats d'Extraction
4. Actions
Workflow (sous-workflow)
Paramètres
Nom
Le nom du module
Workflow
La sélection parmi les workflow existants
Expression d'entrée
Les informations auxquels aura accès le sous-workflow.
Par exemple après un split-pdf, on peut avoir : zip(data['split-pdf']['files'], files['classified'])
On prend les informations renvoyées par split-pdf, ainsi que l'ensemble des fichiers ajoutés dans la collection "classified" par split-pdf. A utiliser avec l'option "Iterate over input".
Workflow Expression
Permet de sélectionner dynamiquement un workflow en fonction d'une expression.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Structure des résultats
Voir Structure des résultats du Workflow
Diviser un document
Ce module permet de séparer un document en sous-documents. Très utile par exemple pour Déliasser un document après une classification page par page. Les sous-documents générés sont stocké dans la collection de sortie
Paramètres
Nom
Le nom du module
Collection de sortie
La collection dans laquelle sont envoyés les sous-documents générés.
Expression d'entrée
Le ou les fichiers à déliasser. files["file"] par défaut.
Labels Expr
La liste des labels de chaque page. Le document sera divisé à chaque fois qu'un label est différent de la page précédente.
Breaks Expr
Expression indiquant les points de découpe (breaks) page à page. Issue par défaut de la prédiction de classification : data['classify']['result']['prediction']['breaks'].
Labels To Ignore
Les pages ayant ce label seront automatiquement mis à l'écart, et ne figureront pas dans les sous-documents générés.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Structure des résultats
Décompresser
Ce module permet de décompresser un dossier archivé et d'extraire les fichiers compressés dans une collection de sortie.
Paramètres
Nom
Le nom du module
Collection de sortie
La collection dans laquelle sont envoyés les fichiers décompressés.
Expression d'entrée
Le ou les fichiers à décompresser. files["file"] par défaut.
Extensions
Une liste d'extension valide. (Exemple : "pdf, doc, jpg, png"). Les fichiers ayant une extension différente dans l'archive seront ignorés.
Max unpack depth
Profondeur maximale de décompression pour les archives imbriquées (archive contenant d'autres archives).
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Structure des résultats
Fusionner des documents
Ce module permet de fusionner les pages de plusieurs documents en entrée en un seul document.
Paramètres
Nom
Le nom du module
Collection de sortie
La collection dans laquelle est envoyé le fichier fusionné.
Nom du fichier de sortie
Le nom du fichier de sortie
Expression d'entrée
Les fichiers à fusionner. files["file"] par défaut.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Structure des résultats
Ensemble Validation — validation d'ensemble
Ce module confronte les résultats d'extraction d'un agent à ceux déjà obtenus afin de valider (ou non) automatiquement les champs concordants.
Paramètres
Nom (Name)
Le nom de l'étape
Agent d'extraction (Extraction agent)
La sélection parmi les agents d'extraction existants, utilisé comme second avis pour la validation.
Expression d'entrée (Input expression)
Le ou les fichiers à valider. files['file'] par défaut.
Extract Expr
Les données d'extraction à confronter. data['extract'] par défaut.
Expression de l'agent d'extraction (Extraction agent expression)
Sélection dynamique de l'agent d'extraction.
Clé de sortie (Output key)
La clé de "data" dans laquelle seront stockées les informations de ce module. ensemble_validation par défaut.
Itérer sur l'entrée (Iterate over input)
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Barcodes — lecture de codes-barres
Ce module détecte et lit les codes-barres présents dans les documents en entrée.
Paramètres
Nom (Name)
Le nom de l'étape
Expression d'entrée (Input expression)
Le ou les fichiers à analyser. files['file'] par défaut.
Clé de sortie (Output key)
La clé de "data" dans laquelle seront stockées les informations de ce module. barcodes par défaut.
Itérer sur l'entrée (Iterate over input)
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
5. Code personnalisé (Custom Code)
Le module Custom Code permet de réaliser des traitements personnalisés en Python, au-delà de ce que proposent les autres modules.
Le paramètre d'entrée job contient toutes les informations utiles dans job.data.
Il est également possible de rajouter de nouvelles informations dans data avec le return.
Pour plus de détails sur le module de code personnalisé, contacter l'équipe reciTAL.
6. État
Les modules d'état peuvent être ajoutés à n'importe quelle transition. Ils permettent de mettre à jour l'état général d'un job, et de notifier si une url de callback a été définie lors de la création du job.
7. Output
Cleanup
Le module Cleanup (étiquette Output) purge les données et les fichiers d'un job — utile en fin de workflow pour ne pas conserver les documents traités. Quatre options permettent de choisir précisément ce qui est conservé :
Nom (Name)
Le nom de l'étape
Keep data
Conserver les données (data) accumulées par le job. Désactiver pour les supprimer.
Keep files
Conserver les fichiers du job. Désactiver pour les supprimer.
Keep history
Conserver l'historique des étapes du job.
Keep preliminary
Conserver les fichiers préliminaires (intermédiaires) générés pendant le traitement.
Webhook
Permet de renvoyer les résultats en cours (ou une partie) vers une URL donnée.
Paramètres
Nom
Le nom du module
URL
L'url de callback
Ignorer les erreurs (Ignore errors?)
Boolean. Si l'option est activée, le flux ne sera pas interrompu, même si le code de réponse est une erreur.
Réessayer en cas d'erreur (Retry on error?)
Boolean. Relance l'appel en cas d'échec.
Expression d'entrée
Les données à renvoyer. "data" par défaut.
Clé de sortie
La clé de "data" dans lesquels seront stockées toutes les informations relatives à ce module.
Itérer sur l'entrée
Activer l'option si l'entrée est une liste. Le module traitera les documents 1 à 1, et la sortie sera une liste de résultats.
Structure des résultats
Last updated

