> ## Documentation Index
> Fetch the complete documentation index at: https://docs.venice.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Traitement de documents

> Extrayez du texte et des décomptes de tokens à partir de documents avec l'API Text Parser de Venice, puis réutilisez la sortie dans les prompts, les embeddings et les pipelines de données.

L'API Text Parser extrait du texte d'un document sans exécuter d'inférence de modèle. Utilisez-la lorsque votre application doit inspecter, stocker, indexer ou réutiliser le contenu d'un document avant de l'envoyer à un modèle.

Les entrées prises en charge incluent les fichiers PDF, DOCX, PPTX, XLSX et texte brut jusqu'à 25 Mo.

## Analyser un document

Téléversez le fichier au format `multipart/form-data` :

```bash theme={"system"}
curl https://api.venice.ai/api/v1/augment/text-parser \
  -H "Authorization: Bearer $VENICE_API_KEY" \
  -F "file=@document.pdf" \
  -F "response_format=json"
```

Le format de réponse par défaut `json` renvoie le texte extrait et son décompte de tokens. Utilisez `response_format=text` lorsque vous n'avez besoin que du texte extrait.

## Text Parser ou entrée de fichier dans le chat ?

Les deux fonctionnalités extraient le contenu d'un document, mais elles servent des flux différents :

| Besoin                                                    | Utiliser                                                       |
| --------------------------------------------------------- | -------------------------------------------------------------- |
| Interroger immédiatement un modèle à propos d'un document | [Entrée de fichier dans le chat](/guides/features/file-inputs) |
| Extraire du texte sans inférence                          | Text Parser                                                    |
| Vérifier le décompte de tokens avant de choisir un modèle | Text Parser                                                    |
| Stocker, indexer ou réutiliser le contenu extrait         | Text Parser                                                    |
| Utiliser le même document dans plusieurs prompts          | Text Parser                                                    |

## Pipeline typique

<Steps>
  <Step title="Analyser le fichier">
    Téléversez le document source et demandez une réponse JSON.
  </Step>

  <Step title="Inspecter la sortie">
    Vérifiez le décompte de tokens par rapport à la fenêtre de contexte du modèle cible. Réduisez ou divisez les documents volumineux avant l'inférence.
  </Step>

  <Step title="Utiliser le texte">
    Ajoutez-le à un prompt de chat, générez des embeddings pour la récupération ou enregistrez-le dans votre propre magasin de données.
  </Step>
</Steps>

<Info>
  L'analyse s'exécute en mémoire sans conservation de données. Venice traite le document téléversé et le supprime immédiatement sans stocker ni journaliser son contenu.
</Info>

<Warning>
  L'API Text Parser est expérimentale. Son format de requête et de réponse peut changer sans préavis.
</Warning>

## Ressources associées

* [Référence de l'API Text Parser](/api-reference/endpoint/augment/text-parser)
* [Entrées de fichier](/guides/features/file-inputs)
* [Embeddings](/guides/features/embeddings)
* [Modèles de texte](/models/text)
