> ## Documentation Index
> Fetch the complete documentation index at: https://docs.venice.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Processamento de Documentos

> Extraia texto e contagem de tokens de documentos com a API Text Parser da Venice e reutilize o resultado em prompts, embeddings e pipelines de dados.

A API Text Parser extrai texto de um documento sem executar inferência de modelo. Use-a quando sua aplicação precisa inspecionar, armazenar, indexar ou reutilizar o conteúdo do documento antes de enviá-lo para um modelo.

Os formatos de entrada suportados incluem PDF, DOCX, PPTX, XLSX e arquivos de texto simples de até 25 MB.

## Analisar um documento

Envie o arquivo como `multipart/form-data`:

```bash theme={"system"}
curl https://api.venice.ai/api/v1/augment/text-parser \
  -H "Authorization: Bearer $VENICE_API_KEY" \
  -F "file=@document.pdf" \
  -F "response_format=json"
```

O formato de resposta padrão `json` retorna o texto extraído e sua contagem de tokens. Use `response_format=text` quando você precisar apenas do texto extraído.

## Text Parser ou entrada de arquivo no chat?

Ambos os recursos extraem o conteúdo de um documento, mas atendem a fluxos de trabalho diferentes:

| Necessidade                                                | Use                                                        |
| ---------------------------------------------------------- | ---------------------------------------------------------- |
| Perguntar imediatamente a um modelo sobre um documento     | [Entrada de arquivo no chat](/guides/features/file-inputs) |
| Extrair texto sem inferência                               | Text Parser                                                |
| Verificar a contagem de tokens antes de escolher um modelo | Text Parser                                                |
| Armazenar, indexar ou reutilizar o conteúdo extraído       | Text Parser                                                |
| Usar o mesmo documento em vários prompts                   | Text Parser                                                |

## Pipeline típico

<Steps>
  <Step title="Analise o arquivo">
    Faça o upload do documento de origem e solicite uma resposta em JSON.
  </Step>

  <Step title="Inspecione o resultado">
    Compare a contagem de tokens com a janela de contexto do modelo de destino. Reduza ou divida documentos grandes antes da inferência.
  </Step>

  <Step title="Use o texto">
    Adicione-o a um prompt de chat, gere embeddings para recuperação ou salve-o em seu próprio armazenamento de dados.
  </Step>
</Steps>

<Info>
  A análise ocorre em memória, com retenção zero de dados. A Venice processa o documento enviado e o descarta imediatamente, sem armazenar ou registrar seu conteúdo.
</Info>

<Warning>
  A API Text Parser é experimental. Seu formato de requisição e resposta pode mudar sem aviso prévio.
</Warning>

## Recursos relacionados

* [Referência da API Text Parser](/api-reference/endpoint/augment/text-parser)
* [Entradas de arquivo](/guides/features/file-inputs)
* [Embeddings](/guides/features/embeddings)
* [Modelos de texto](/models/text)
