Pular para o conteúdo principal
A API Text Parser extrai texto de um documento sem executar inferência de modelo. Use-a quando sua aplicação precisa inspecionar, armazenar, indexar ou reutilizar o conteúdo do documento antes de enviá-lo para um modelo. Os formatos de entrada suportados incluem PDF, DOCX, PPTX, XLSX e arquivos de texto simples de até 25 MB.

Analisar um documento

Envie o arquivo como multipart/form-data:
O formato de resposta padrão json retorna o texto extraído e sua contagem de tokens. Use response_format=text quando você precisar apenas do texto extraído.

Text Parser ou entrada de arquivo no chat?

Ambos os recursos extraem o conteúdo de um documento, mas atendem a fluxos de trabalho diferentes:

Pipeline típico

1

Analise o arquivo

Faça o upload do documento de origem e solicite uma resposta em JSON.
2

Inspecione o resultado

Compare a contagem de tokens com a janela de contexto do modelo de destino. Reduza ou divida documentos grandes antes da inferência.
3

Use o texto

Adicione-o a um prompt de chat, gere embeddings para recuperação ou salve-o em seu próprio armazenamento de dados.
A análise ocorre em memória, com retenção zero de dados. A Venice processa o documento enviado e o descarta imediatamente, sem armazenar ou registrar seu conteúdo.
A API Text Parser é experimental. Seu formato de requisição e resposta pode mudar sem aviso prévio.

Recursos relacionados