Skip to main content
A maioria dos modelos de linguagem é projetada para gerar texto. Quando uma aplicação precisa de uma decisão, isso geralmente significa pedir JSON a um modelo, validar a resposta e extrair o valor que controla o próximo passo. O Jev é um modelo de decisão System One. Em vez de gerar prosa, ele avalia um state em relação a perguntas com tipos de resposta predefinidos e retorna julgamentos prontos para consumo por máquinas.
O Jev e a API de Decisões estão em beta. A disponibilidade e o comportamento podem mudar sem aviso prévio.

Um ticket de suporte se torna uma decisão

Suponha que esta mensagem chegue:
Meus pagamentos falharam por três dias e ninguém respondeu. Por favor, ajudem URGENTE.
Sua aplicação precisa saber para onde encaminhá-lo, se é urgente e quão frustrado o cliente parece estar. Envie a mensagem uma única vez e faça as três perguntas juntas:
cURL
O Jev retorna uma resposta sob cada ID de pergunta:
As probabilidades variam entre requisições. Avalie o Jev com exemplos da sua própria aplicação antes de escolher limites para produção.

Escolha o formato da resposta

O Jev suporta três tipos de perguntas:

Noul: faça um julgamento binário

Use Noul quando a probabilidade de sim é diretamente útil:
Noul não possui um campo confidence separado. Um valor próximo de 1 é um sim forte, próximo de 0 é um não forte, e próximo de 0.5 é incerto.

Choice: encaminhe ou classifique

Use Choice quando a resposta precisa ser uma opção de um conjunto fechado:
Inclua uma opção other ou none quando as escolhas fornecidas podem não cobrir todos os estados.

Score: meça um espectro

Use Score quando a resposta se encaixa em níveis ordenados:
Os índices dos níveis começam em 0. A pontuação retornada é ponderada por probabilidade, portanto pode ficar entre dois níveis.

Transforme confiança em comportamento da aplicação

As respostas de Choice e Score incluem tanto a distribuição completa quanto um único valor de confidence derivado dela. Isso permite que seu código trate a resposta e a certeza como sinais separados:
Use limites mais altos para ações que sejam caras, destrutivas, financeiras ou difíceis de reverter. A confiança não garante correção; ela ajuda sua aplicação a decidir quando não agir automaticamente.

Faça perguntas relacionadas em conjunto

Cada pergunta em uma requisição recebe o mesmo state e é avaliada de forma independente. A resposta de departamento não se torna contexto oculto para a pergunta sobre frustração. Agrupe perguntas independentes quando:
  • Elas avaliam o mesmo documento, registro, conversa ou estado da aplicação.
  • Seu código pode precisar de várias respostas dependendo do primeiro resultado.
  • Você quer evitar enviar o mesmo state em múltiplas requisições.
Faça uma segunda requisição apenas quando seu state ou opções disponíveis realmente dependerem de uma resposta anterior.

Use state estruturado

state pode ser uma string, um objeto JSON ou um array. Um state estruturado permite que as perguntas se refiram a registros específicos e ao contexto de apoio:
Escreva instruções completas e nomeie os campos relevantes, por exemplo: “O ticket.message solicita um reembolso coberto pela refund_policy?”

Descubra o Jev e seus limites

Use sua chave de API ao listar modelos de decisão, pois a disponibilidade de modelos pode variar por conta:
cURL
O modelo jev-latest atualmente suporta:
  • Até 32.000 tokens para o state mais a pergunta individual mais longa
  • Até 64.000 tokens para o state mais todas as perguntas combinadas
  • Entrada de texto ou JSON estruturado
Trate a API de Modelos como fonte autoritativa, pois preços, limites e disponibilidade podem mudar.

Quando usar outro modelo

Use o Jev para julgamentos delimitados que seu software possa aplicar diretamente. Use um modelo de chat ou de raciocínio quando você precisar de:
  • Prosa ou explicações geradas
  • Conversa multi-turno
  • Chamada de ferramentas (tool calling)
  • Respostas abertas
  • Uma longa cadeia de raciocínio dependente

Próximos passos