Documentação

Modelos

O Jev é o modelo carro-chefe da TypeSafe e o primeiro modelo System One. Todos os modelos desta página são servidos pelo mesmo endpoint, POST /v1/systemone. O campo model da requisição seleciona qual deles atende à chamada; consulte a referência da API para ver o formato completo da requisição.

Modelos atuais

Jev 1.13 jev-1.13.0
Preço (por Btok / por Mtok) $42 / $0.042
Limites de taxa 100K tokens por segundo / 80 requisições por segundo
Comprimento de contexto 64k tokens por requisição; 32k tokens para o state mais a pergunta mais longa
Entrada Apenas texto. String, objeto JSON ou array de valores de texto. Sem entrada de imagem, áudio ou vídeo.
  • Preço: Cobrado por token de entrada. Os tokens de saída são gratuitos. Um Btok é um bilhão de tokens e um Mtok é um milhão de tokens.
  • Limites de taxa: Medidos em tokens por segundo e requisições por segundo. Uma requisição acima de qualquer um dos limites retorna 429 Too Many Requests. Os nossos SDKs de cliente tentam de novo com backoff exponencial por padrão e respeitam o cabeçalho retry-after quando a resposta o traz. Se você chamar a API HTTP diretamente, consulte Como lidar com limites de taxa.
  • Comprimento de contexto: O Jev ingere o state uma vez e avalia cada pergunta contra ele em paralelo. O orçamento de 64k cobre o state mais todas as perguntas combinadas; o orçamento de 32k se aplica ao state mais a única pergunta mais longa. Consulte Fan-out especulativo para empacotar muitas perguntas em uma única requisição, e Jaggedness do Jev 1.13 para ver como a precisão muda conforme o estado cresce.
  • Entrada: O Jev avalia texto em linguagem natural. Pré-processe entradas que não são texto (imagens, áudio, vídeo, binários) em texto ou campos estruturados antes de enviá-las como state. Consulte Estado para ver os formatos compatíveis.

Aliases

Um alias é um nome de modelo que resolve para um ID de modelo versionado. Envie-o no campo model como qualquer outro nome.

Alias Aponta para Significado
jev-latest jev-1.13.0 A versão oficial estável mais recente. É o padrão nos nossos SDKs de cliente e o nome que os exemplos desta documentação usam.
jev-preview jev-1.13.0 A versão mais recente, seja oficial ou não. Passa à frente de jev-latest quando há uma versão de pré-visualização disponível.

Um alias muda quando uma nova versão é lançada, então as respostas por trás dele podem mudar sem nenhuma mudança do seu lado. O campo model da resposta informa o ID versionado que respondeu, para que você possa registrar qual modelo produziu cada resultado. Se você ajustou limiares de confiança para uma versão específica, fixe o ID dessa versão em vez do alias e migre para a nova versão conforme o seu próprio cronograma.

Personalizar o Jev

O Jev não é ajustado nem adaptado com LoRA usando dados de clientes. Ele é treinado com RLCD para devolver decisões calibradas, e os mesmos pesos atendem todas as contas. Você molda as respostas ao seu domínio pela requisição, e não por pesos por conta:

  • Coloque o seu conteúdo proprietário, os seus registros e o seu material de referência no campo state. Consulte Estado.
  • Codifique as regras do seu domínio e os casos limítrofes nas instructions e nos criteria de cada pergunta. Consulte Como construir com TypeSafe e Avançado: estrutura.
  • Decomponha julgamentos amplos em perguntas atômicas e combine as saídas no código. Consulte Pontuação composta e o cookbook de AutoResearch para treinar um modelo clássico posterior com as probabilidades do Jev.

Suporte a idiomas

O Jev aceita texto em linguagem natural. O inglês é o idioma principal de treinamento e onde a precisão é melhor atualmente. Outros idiomas, incluindo escritas CJK, são tratados, mas não igualmente bem; teste com o seu próprio conteúdo antes de depender do Jev para uma carga de trabalho que não seja em inglês, e preste muita atenção à Confiança ao rotear.

Tratamento de dados

O Jev não é treinado com requisições nem respostas de clientes. Consulte Legal para ver o Contrato de Processamento de Dados, a Política de Privacidade e os detalhes sobre retenção zero de dados (ZDR) para clientes corporativos.

Listar modelos

GET /v1/models devolve os nomes que a sua conta pode enviar no campo model, com uma descrição e uma data de lançamento para cada um. Atualmente lista os aliases. IDs versionados como jev-1.13.0 são aceitos pelo campo model, estejam ou não na lista.

curl https://api.typesafe.ai/v1/models \
  -H "Authorization: Bearer $TYPESAFE_API_KEY"
from typesafe_sdk import TypeSafeClient

with TypeSafeClient() as client:
    for model in client.models.list().models:
        print(model.name, model.release_date, model.description)
import { TypeSafeClient } from "@typesafe-ai/sdk";

const client = new TypeSafeClient();
const models = await client.models.list();
for (const model of models) {
  console.log(model.name, model.release_date, model.description);
}

modelsarray · required

Uma entrada por modelo ou alias.

propriedades

namestring · required

O ID ou alias do modelo, como aceito pelo campo model.

descriptionstring · required

Para que serve o modelo.

release_datestring · required

Quando o modelo ou alias foi lançado.

Consulte as referências do SDK de Python e JavaScript para ver as assinaturas completas dos métodos.