Skip to main content
La maggior parte dei modelli linguistici è progettata per generare testo. Quando un’applicazione ha bisogno di una decisione, ciò significa spesso chiedere al modello un JSON, validare la risposta ed estrarre il valore che controlla il passo successivo. Jev è un modello decisionale System One. Invece di generare prosa, valuta uno state rispetto a domande con tipi di risposta predefiniti e restituisce giudizi pronti per essere elaborati.
Jev e l’API Decisions sono in beta. La disponibilità e il comportamento possono cambiare senza preavviso.

Un ticket di supporto diventa una decisione

Supponiamo che arrivi questo messaggio:
I miei pagamenti sono falliti da tre giorni e nessuno ha risposto. Aiutatemi al più presto.
La tua applicazione deve sapere dove instradarlo, se è urgente e quanto appare frustrato il cliente. Invia il messaggio una sola volta e poni tutte e tre le domande insieme:
cURL
Jev restituisce una risposta per ciascun ID di domanda:
Le probabilità variano da una richiesta all’altra. Valuta Jev su esempi presi dalla tua applicazione prima di scegliere le soglie da usare in produzione.

Scegli la forma della risposta

Jev supporta tre tipi di domanda:

Noul: esprimi un giudizio binario

Usa Noul quando la probabilità di sì è direttamente utile:
Noul non ha un campo confidence separato. Un valore vicino a 1 è un sì convinto, vicino a 0 è un no convinto, e vicino a 0.5 è incerto.

Choice: instrada o classifica

Usa Choice quando la risposta deve essere una tra un insieme chiuso:
Includi un’opzione other o none quando le scelte fornite potrebbero non coprire ogni stato.

Score: misura uno spettro

Usa Score quando la risposta si colloca su livelli ordinati:
Gli indici dei livelli partono da 0. Il punteggio restituito è ponderato per probabilità, quindi può cadere tra due livelli.

Trasforma la confidenza in comportamento dell’applicazione

Le risposte di tipo Choice e Score includono sia la distribuzione completa sia un singolo valore di confidence da essa derivato. Questo consente al tuo codice di trattare la risposta e la certezza come segnali separati:
Usa soglie più alte per azioni costose, distruttive, finanziarie o difficili da annullare. La confidenza non garantisce la correttezza; aiuta la tua applicazione a decidere quando non agire automaticamente.

Poni insieme domande correlate

Ogni domanda in una richiesta riceve lo stesso stato ed è valutata in modo indipendente. La risposta sul dipartimento non diventa contesto nascosto per la domanda sulla frustrazione. Raggruppa domande indipendenti quando:
  • Valutano lo stesso documento, record, conversazione o stato dell’applicazione.
  • Il tuo codice potrebbe aver bisogno di più risposte a seconda del primo risultato.
  • Vuoi evitare di inviare lo stesso stato in più richieste.
Fai una seconda richiesta solo quando il suo stato o le scelte disponibili dipendono davvero da una risposta precedente.

Usa uno stato strutturato

state può essere una stringa, un oggetto JSON o un array. Uno stato strutturato consente alle domande di fare riferimento a record specifici e a un contesto di supporto:
Scrivi istruzioni complete e nomina i campi rilevanti, ad esempio: “ticket.message richiede un rimborso coperto da refund_policy?”

Scopri Jev e i suoi limiti

Usa la tua chiave API quando elenchi i modelli decisionali, perché la disponibilità dei modelli può variare in base all’account:
cURL
Il modello jev-latest supporta attualmente:
  • Fino a 32.000 token per state più la singola domanda più lunga
  • Fino a 64.000 token per state più tutte le domande combinate
  • Input testuale o JSON strutturato
Considera l’API Models come autorevole, perché prezzi, limiti e disponibilità possono cambiare.

Quando usare un altro modello

Usa Jev per giudizi delimitati su cui il tuo software può agire direttamente. Usa un modello di chat o di ragionamento quando hai bisogno di:
  • Prosa o spiegazioni generate
  • Conversazione a più turni
  • Chiamata di strumenti
  • Risposte aperte
  • Una lunga catena di ragionamento dipendente

Prossimi passi