For the complete documentation index, see llms.txt. This page is also available as Markdown.

Chaînage de modèle Extraction

Extrayez des données à partir des plages de découpage détectées.

Utilisez les plages Split pour extraire automatiquement les données du document, ce qui permet plusieurs extractions différentes sur un fichier multipage.

Remarque : les Modèles Split fonctionnent également sur des fichiers d’une seule page ; dans ce cas, la plage fera toujours exactement une page. Si vous avez besoin de plusieurs résultats d’extraction sur la même page, consultez plutôt Modèles Crop à la place.

Mise en place de l’extraction

Lors de la création du modèle

Lorsque vous créez votre modèle Split, vous ajouterez des classes de documents dans la fenêtre de création.

Pour chaque classe de document, vous pouvez définir l’un de vos Modèles Extraction pour l’enchaînement. Le modèle d’extraction doit exister avant la création du modèle Split.

Utilisez le champ de recherche pour filtrer les modèles d’extraction disponibles.

Configuring extraction model chaining on Split creation

Après la création du modèle

Cela fonctionne exactement comme lors de la création du modèle.

Il vous suffit d’aller sur la page « Configuration utilitaire » de votre modèle Split et de l’ajuster selon vos besoins.

Vous pouvez ajouter de nouvelles classes, supprimer des classes et modifier les Modèles Extraction.

Configuring extraction model chaining on Split after creation

Extraction sélective

Si une classe détectée n’a aucun modèle d’extraction lié, aucune extraction n’est effectuée pour cette zone de recadrage.

Cela permet d’extraire sélectivement certaines sections du fichier tout en en ignorant d’autres.

Supposons que vous receviez de vos utilisateurs de gros PDF multipages, où chaque PDF est un ensemble de différents documents numérisés : billets d’avion, reçus de voyage, permis de conduire et passeport.

Vous n’avez besoin que des passeports.

Dans votre configuration Split, ajoutez un passeport classe et un autre classe, et ne liez un modèle d’extraction qu’à la passeport classe.

Toutes les plages Split seront classées, mais seules celles liées à un modèle d’extraction auront des résultats d’extraction.

Ajoutez toujours une autre classe en plus des classes qui vous intéressent, à moins que tous les types de documents potentiels ne soient connus à l'avance.

Suppression des pages inutilisées

Il est également possible de supprimer des pages qui ne sont jamais utilisées dans l’extraction. Par exemple, pour supprimer les conditions générales des factures, configurez les classes terms_and_conditions_page et invoice_page , et ne liez un modèle d’extraction qu’à la invoice_page classe.

Accéder aux résultats d’extraction

Lorsqu’un modèle d’extraction est lié, chaque plage Split correspondant à la classe détectée contiendra un objet de réponse d’extraction, identique à celui obtenu lors d’une requête d’extraction pour un seul document.

Vérifiez le Résultat Split section pour plus de détails.

Mis à jour

Ce contenu vous a-t-il été utile ?