For the complete documentation index, see llms.txt. This page is also available as Markdown.

Chaînage de modèle Extraction

Extraire des données à partir des plages de découpage détectées.

Utilisez des plages de Split pour extraire automatiquement les données du document, ce qui permet plusieurs extractions différentes sur un fichier multipage.

Remarque : les Modèles Split fonctionnent également sur des fichiers d’une seule page ; dans ce cas, la plage sera toujours exactement d’une page. Si vous avez besoin de plusieurs résultats d’extraction sur la même page, consultez plutôt Modèles Crop à la place.

Configuration d’extraction

À la création du modèle

Lorsque vous créez votre modèle Split, vous ajouterez des classes de document dans la fenêtre de création.

Pour chaque classe de document, vous pouvez définir l’un de vos Modèles Extraction pour le chaînage. Le modèle Extraction doit exister avant la création du modèle Split.

Utilisez le champ de recherche pour filtrer les modèles d’extraction disponibles.

Configuring extraction model chaining on Split creation

Après la création du modèle

Cela fonctionne exactement comme lors de la création du modèle.

Il vous suffit d’aller sur la page « Configuration utilitaire » de votre modèle Split et d’ajuster les paramètres selon vos besoins.

Vous pouvez ajouter de nouvelles classes, supprimer des classes et modifier les Modèles Extraction.

Configuring extraction model chaining on Split after creation

Extraction sélective

Si une classe détectée n’a aucun modèle Extraction lié, aucune extraction n’est exécutée pour ce recadrage.

Cela permet d’extraire sélectivement certaines sections du fichier tout en en ignorant d’autres.

Supposons que vous receviez de vos utilisateurs de grands PDF multipages, dans lesquels chaque PDF est un ensemble de différents documents numérisés : billets d’avion, reçus de voyage, permis de conduire et passeport.

Vous n’avez besoin que des passeports.

Dans votre configuration Split, ajoutez un passeport classe et un autre classe, et ne liez un modèle d’extraction qu’à la passeport classe.

Toutes les plages de Split seront classées, mais seules celles liées à un modèle Extraction auront des résultats d’extraction.

Ajoutez un autre une classe en plus des classes qui vous intéressent, sauf si tous les types de documents potentiels sont connus à l'avance.

Suppression des pages inutilisées

Il est également possible de supprimer les pages qui ne sont jamais utilisées dans l’extraction. Par exemple, pour supprimer les conditions générales des factures, configurez les classes terms_and_conditions_page et invoice_page , et ne liez un modèle d’extraction qu’à la invoice_page classe.

Utilisation des jetons avec chaînage

Vous ne consommez les jetons qu’une seule fois ; il n’y a pas de double facturation lorsque vous l’enchaînez avec un modèle d'extraction.

Les scénarios possibles de consommation de crédits sont les suivants :

  • modèle d'extraction non chaîné ⇒ utilisation des jetons du modèle initial (Split, Crop, Classification)

  • modèle d'extraction chaîné ⇒ utilisation des jetons du modèle d'extraction configuré, y compris tout élément activé Fonctionnalités optionnelles.

Autrement dit, le modèle initial vous est fourni sans coût supplémentaire s’il déclenche un traitement supplémentaire à l’aide d’un modèle d'extraction.

Toute consommation de jetons est effectuée par page, comme c’est la norme pour nos modèles.

Accéder aux résultats d’extraction

Lorsqu’un modèle Extraction est lié, chaque plage Split avec la classe détectée contiendra un objet de réponse d’extraction, identique à celui obtenu lors d’une requête d’extraction pour un seul document.

Consultez la Résultat Split section pour plus de détails.

Mis à jour

Ce contenu vous a-t-il été utile ?