Vai al contenuto principale
L’API Text Parser estrae il testo da un documento senza eseguire inferenza di modello. Usala quando la tua applicazione ha bisogno di ispezionare, memorizzare, indicizzare o riutilizzare il contenuto di un documento prima di inviarlo a un modello. Gli input supportati includono file PDF, DOCX, PPTX, XLSX e file di testo semplice fino a 25 MB.

Analizzare un documento

Carica il file come multipart/form-data:
Il formato di risposta predefinito json restituisce il testo estratto e il suo conteggio dei token. Usa response_format=text quando ti serve solo il testo estratto.

Text Parser o file input della chat?

Entrambe le funzionalità estraggono il contenuto dei documenti, ma servono flussi di lavoro diversi:

Pipeline tipica

1

Analizza il file

Carica il documento sorgente e richiedi una risposta JSON.
2

Ispeziona l'output

Confronta il conteggio dei token con la finestra di contesto del modello di destinazione. Riduci o suddividi i documenti di grandi dimensioni prima dell’inferenza.
3

Usa il testo

Aggiungilo a un prompt della chat, genera embedding per il retrieval oppure salvalo nel tuo data store.
L’analisi viene eseguita in memoria con zero retention dei dati. Venice elabora il documento caricato e lo scarta immediatamente senza memorizzarne o registrarne il contenuto.
L’API Text Parser è sperimentale. Il formato di richiesta e risposta può cambiare senza preavviso.

Risorse correlate