Passer au contenu principal
Venice fournit des API distinctes pour découvrir des pages web et en extraire le contenu :
  • Web Search renvoie des résultats structurés comprenant titres, URL, extraits et dates.
  • Web Scrape convertit une page publique sélectionnée en Markdown.
Utilisez-les ensemble lorsque votre application a besoin d’un matériau source actuel et inspectable avant l’inférence.

Rechercher sur le web

Envoyez une requête à l’API Search :
Brave est le fournisseur par défaut et offre une non-conservation des données (Zero Data Retention). Google est également disponible avec des requêtes anonymisées transitant par Venice. Consultez la référence de l’API Web Search pour la sélection du fournisseur et le schéma de réponse complet.

Extraire une page

Après avoir sélectionné un résultat, envoyez son URL publique à l’API Scrape :
Le point de terminaison renvoie le contenu de la page au format Markdown. Il demande d’abord la représentation Markdown native du site lorsqu’elle est disponible et, à défaut, utilise une extraction basée sur un navigateur.

Flux Search-to-Scrape

1

Rechercher

Soumettez une requête ciblée et collectez les résultats structurés.
2

Sélectionner les sources

Filtrez les résultats par pertinence, domaine et date avant de récupérer le contenu des pages.
3

Extraire

Extrayez le Markdown uniquement des pages que votre application a l’intention d’utiliser.
4

Utiliser ou stocker le contenu

Incluez le Markdown dans un prompt, créez des embeddings, mettez-le en cache ou conservez les URL sources pour les citations.

API de recherche autonome ou recherche web du modèle ?

Utilisez les API autonomes lorsque votre application a besoin de contrôler la sélection des sources ou souhaite réutiliser le contenu récupéré. Activez la recherche web sur une requête de modèle lorsque vous souhaitez que Venice gère la récupération dans le cadre d’une seule requête d’inférence.
Web Search et Web Scrape sont des API expérimentales. Leurs formats de requête et de réponse peuvent changer sans préavis. Web Scrape n’accepte que les pages accessibles publiquement, et les sites qui bloquent l’accès automatisé peuvent être rejetés.

Ressources associées