> For the complete documentation index, see [llms.txt](https://docs.mindee.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.mindee.com/v2/fr/modeles-de-texte-brut-ocr/ocr.md).

# Aperçu du modèle de texte brut

## Cas d’utilisation

Lorsque l’intégralité du texte d’un document doit être extraite, ainsi que les informations de position de chaque mot.

Nous utilisons le terme « OCR » au sens littéral, comme acronyme de « Optical Character Recognition ».

Cela signifie que le texte exact est renvoyé en tant que données brutes, et non analysé en données structurées sous forme de champs.

{% hint style="info" %}
**La plupart des utilisateurs qui recherchent un « Mindee OCR » générique ou à « faire de l’OCR sur un document » recherchent probablement Extraction : c**consultez le [documentation du modèle d’extraction](/v2/fr/modeles-extraction/extraction-models-overview.md).
{% endhint %}

Un fichier envoyé au modèle Raw Text Modèles OCR peut comporter n’importe quel nombre de pages, [dans certaines limites](/v2/fr/integrations/technical-limitations.md#file-limits).

### Différence entre Raw Text *Modèle* et Raw Text *Option*

Le [modèle d’extraction](/v2/fr/modeles-extraction/extraction-models-overview.md) a la [fonctionnalité optionnelle Raw Text](/v2/fr/modeles-extraction/optional-features/raw-text-full-ocr.md) qui peut être utilisée dans des cas d’utilisation similaires, selon vos besoins.

**Option Raw Text :** renvoie l’intégralité du texte de chaque page sous forme d’une seule chaîne.

**Modèle Raw Text :** en plus de la seule chaîne par page, renvoie également chaque mot de la page. Chaque mot comporte des informations de position et le contenu textuel.

### Prise en charge des langues

Presque toutes les langues sont entièrement prises en charge, car seul le système d’écriture intervient dans la détection.

Autrement dit, tant que le système peut reconnaître les glyphes (les lettres d’un alphabet), le texte sera extrait.

Il est beaucoup plus simple et plus court de lister ce qui n’est **pas** pris en charge :

* Les langues anciennes sans système d’écriture moderne équivalent, comme le cunéiforme, les hiéroglyphes égyptiens, l’ancien maya, etc.
* Les langues modernes dotées de systèmes d’écriture peu courants, comme Blackfoot, Cherokee, Inuktitut, etc.

## Créer un modèle Raw Text Modèles OCR

Les modèles OCR Raw sont toujours personnalisés, aucun modèle prédéfini n’est disponible dans le catalogue.

Chaque modèle OCR reçoit son propre ID de modèle unique lorsque vous le créez.

1. Pour créer un modèle OCR, cliquez sur **Modèles**, puis cliquez sur **Créez votre modèle d’IA documentaire**.
2. Faites défiler jusqu’à la **Utilitaires de document** section, cliquez sur **OCR.**\
   Cette étape générera également l’ID de modèle unique du modèle.
3. Vous pouvez maintenant utiliser l’ **Live test** onglet pour traiter des documents.<br>

Votre modèle OCR est désormais disponible dans votre **Modèles** onglet :

<figure><img src="/files/e7ef9f945aed63e9bdb8b8db738e34fc1d411578" alt=""><figcaption></figcaption></figure>

Voici un tutoriel étape par étape qui vous montre comment créer correctement un utilitaire OCR :

{% @supademo/embed url="<https://app.supademo.com/demo/cmlrrputf0pnh1189ay3tsdkt>" demoId="cmlrrputf0pnh1189ay3tsdkt" %}

## Intégration

Une fois votre modèle OCR créé et testé, la documentation d’intégration est fournie sur la page « Documentation », ou ici : [Démarrage rapide OCR](/v2/fr/modeles-de-texte-brut-ocr/sdk-integration/ocr-quick-start.md)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.mindee.com/v2/fr/modeles-de-texte-brut-ocr/ocr.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
