Analyseur de texte
Extracts text from a document file. Supports PDF, DOCX, PPTX, XLSX, and plain text formats. Upload a file via multipart/form-data.
Privacy: Text parsing runs entirely in-memory on Venice’s infrastructure with zero data retention. Documents are processed and immediately discarded — no content is stored or logged.
Authentication: This endpoint accepts either a Bearer API key or a SIGN-IN-WITH-X header for x402 wallet-based authentication. The legacy X-Sign-In-With-X header is also accepted during migration. When using x402, a 402 Payment Required response indicates insufficient balance and includes top-up instructions.
file, jusqu’à 25 Mo.
Les formats pris en charge vont au-delà des seuls documents structurés. L’endpoint accepte :
- Documents — PDF, EPUB, DOCX, PPTX, XLSX, XLS
- Texte brut et données — texte brut, Markdown, CSV, JSON, YAML, TOML, XML, et tout type MIME
text/* - Code source — environ 140 extensions reconnues, dont
.py,.ts,.js,.go,.rs,.c,.cpp,.java,.ps1,.sh,.sql, ainsi que les fichiers sans extension commeDockerfileetMakefile
.doc et .ppt ne sont pas acceptés — convertissez-les d’abord en .docx ou .pptx. L’ancien format .xls, lui, est accepté.response_format sur json (par défaut) pour une sortie structurée avec le texte extrait et le nombre de tokens, ou sur text pour le texte brut extrait.
Confidentialité : L’analyse de texte s’exécute entièrement en mémoire sur l’infrastructure de Venice avec zéro rétention de données. Vos documents sont traités puis immédiatement supprimés — aucun contenu n’est stocké ni enregistré.
Tarification : 0,01 $ par requête.
Exemple (cURL)
Autorisations
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
Corps
The document file to parse. Supported formats: PDF, DOCX, PPTX, XLSX, and plain text files. Maximum size: 25MB.
The format of the response output. "json" returns structured JSON with text and token count, "text" returns only the extracted text.
json, text