Documentação

Lista de projetos

60 projetos, organizados pelo que você está tentando resolver. Uma linha para cada, com uma contagem de estrelas e uma data de instantâneo.

Como ler uma linha

  • A contagem de estrelas reflete atenção e uso, não qualidade; a data ao lado é quando isso foi lido.
  • O nível de evidência (reproduzível / implementado) responde “quanto é possível verificar”, não se é bom. Algumas linhas de código que publicam resultados brutos e um projeto completo cujos números vêm todos do autor ficam em níveis diferentes — e isso não tem nada a ver com a utilidade de qualquer um deles.

60 projetos. As estrelas são de 2026-09-24.

Reprodutível
Publica artefatos brutos, conjuntos de dados ou uma avaliação que pode ser executada novamente.
Implementado
Código legível com testes; os números são do próprio autor.

Interfaces e navegadores

Cenas em que cada passo é um clique. As decisões são baratas o bastante para perguntar a cada passo.

  • Jev Ultrafast19,456★Implementado

    O agente ultrarrápido do Browser Use: o modelo de decisão escolhe a operação e o elemento do DOM numa única requisição, e um LLM pequeno só é chamado quando é preciso digitar texto.

  • jev-chat-jarvis5,561★Implementado

    Um copiloto de conversa no celular: lê a outra pessoa no WeChat, QQ, X ou Feishu, propõe respostas e preenche a caixa de texto — o envio continua manual. Ele só lê a tela, não faz hook nem altera o pacote.

  • typesafe-computer-use937★Implementado

    Uso do computador no macOS: faz OCR da tela, classifica a próxima ação com o modelo de decisão e clica. O autor relata cerca de $0.0002 por passo.

  • hermes-jev-skills726★Implementado

    Um conjunto de skills para agentes Hermes: roteamento de modelos, memória, compactação de contexto, seleção de skills e uso do computador ou do navegador — também instala no Claude Code e no Codex.

  • jev-browser-use453★Implementado

    Deixa o modelo de decisão escolher o clique enquanto o Codex pensa e verifica — operações de navegador relatadas 5–10× mais rápidas.

  • typesafe-mario383★Implementado

    Um agente que joga Super Mario Bros. a partir do estado estruturado do emulador em vez de pixels.

  • mobile-jev380★Implementado

    Um agente Android independente em que o modelo de decisão toma todas as decisões, com um estúdio ao vivo que mostra a telemetria das decisões.

  • jev-chat-jarvis-mac346★Implementado

    Um overlay de detecção de intenção para o WeChat (macOS): leitura de tela e um modelo pequeno local para julgar intenção e risco, depois respostas candidatas — estritamente somente leitura, nada é injetado no WeChat.

  • jev-voice-browser271★Implementado

    Controlar um navegador real por voz: a intenção e o alvo são decididos em cerca de 300 ms por palavra falada, e o Playwright executa — muitas vezes antes de você terminar a frase.

  • jev-browser257★Implementado

    Uso do navegador guiado pelo modelo de decisão.

  • unclutter227★Implementado

    Uma extensão de navegador que usa o modelo de decisão para encontrar e remover o que polui a página, com regras que podem ser salvas como modelos reutilizáveis.

  • embodied-jev221★Implementado

    Um ambiente de trabalho de decisão para robôs no MuJoCo.

  • jev-drone170★Implementado

    Um drone autônomo só com câmera no MuJoCo, com a etapa de decisão rodando a 2.5 Hz.

Pôr freios num agente

A segunda camada de julgamento de um agente de código: liberar ou não, se terminou, o que ainda é necessário no contexto.

  • fast-jev-compaction6,653★Implementado

    Um plugin do Claude Code que substitui o resumo de compactação por decisões: cada chamada de ferramenta e seu resultado é pontuada em uma única requisição, o que está obsoleto é descartado ou truncado, e o que é mantido permanece literal.

  • foreman540★Implementado

    Um supervisor de agentes que usa decisões para manter os agentes de código na tarefa.

  • JevHarness191★Implementado

    Harnesses de decisão específicos de tarefa escritos por um LLM, com reflexão de recompensa sobre toda a trajetória e evolução por GEPA como opção.

  • jev-dsh-decision163★Implementado

    Um plugin de decisão estruturada para harnesses de agentes: nativo no DeepSeek Harness e, via iPolloWork, também OpenCode e Codex Harness.

  • jev-pruner144★Implementado

    Um plugin do Claude Code que corta saídas longas do Bash antes que o modelo as veja.

  • pi-jev (y0usaf)144★Implementado

    Uma camada de decisão para o agente de código Pi: um portão de chamadas de ferramenta medido mais jev_ask para respostas tipadas e calibradas.

  • pi-warden138★Implementado

    Guardrails para o Pi que orientam em vez de interromper: o modelo de decisão julga chamadas de ferramenta irreversíveis ou fora da tarefa, detecta loops travados e verifica conclusões declaradas mas não comprovadas.

  • building-with-jev-skill131★Implementado

    Uma skill para escrever e melhorar programas que chamam o modelo de decisão.

Roteamento, busca e revisão

Decidir quem cuida disso, ou escolher entre os candidatos quais vale a pena olhar.

  • jev-review (devagrawal09)586★Implementado

    Um fluxo de revisão de código por etapas, com um painel local.

  • jev-search446★Implementado

    Busca na web com o modelo de decisão: seleção de fontes, compreensão da consulta e ordenação por relevância.

  • jev-router (gargpratyush)377★Implementado

    Encaminha as tarefas do Claude Code para o modelo suficiente e mais barato, pedindo ao modelo de decisão que escolha entre os candidatos.

  • pg-jev329★Implementado

    Uma extensão do PostgreSQL para fazer perguntas às suas tabelas em linguagem simples.

  • jev-codex-router263★Implementado

    Roteamento turno a turno para o Codex: cada turno decide de novo o modelo, a profundidade de raciocínio e o modo de velocidade.

  • jev-review (NiazMorshed2007)218★Implementado

    Um plugin MCP local-first para revisão contínua de qualidade de software por agentes de código.

  • notra215★Implementado

    Uma plataforma de análise de marketing que migrou um classificador de visibilidade de marca de um LLM para decisões booleanas, com troca controlada por feature flag.

  • JevRouter190★Implementado

    Um roteador leve para modelos, ferramentas e subagentes.

  • perch171★Implementado

    Um CLI que analisa um repositório em um grafo de chamadas em nível de método e depois pede ao modelo de decisão que sinalize possíveis defeitos e verifique regras de projeto escritas em inglês simples.

  • jev-semgrep134★Implementado

    Grep por significado em vez de padrão: cada linha recebe uma pontuação em relação a um significado, e os significados se combinam com AND / OR / NOT.

  • neo4jev129★Implementado

    Percorre um grafo Neo4j salto a salto, classificando cada aresta de saída candidata, com beam search sobre as log-probabilidades da resposta.

Alternativas locais e abertas

Pesos abertos e runtimes locais por trás da mesma interface HTTP.

  • SemIf4,162★Reprodutível

    ifs semânticos com modelos abertos, numa única 3090 em casa. Projeto independente, sem relação com o fornecedor.

  • NanoJev2,159★Reprodutível

    Uma réplica de 0.6B: decisões paralelas sobre candidatos dinâmicos, sem decodificar nenhum token de saída, com o pipeline de treinamento de ponta a ponta.

  • jevlike1,279★Reprodutível

    Treine um modelo pequeno que escolhe numa lista de opções de texto que cresce e encolhe, com uma probabilidade por opção numa única passagem — com demos de Doom, xadrez e Wikispeedia.

  • von610★Reprodutível

    Um modelo não autorregressivo de 395M que responde perguntas tipadas com probabilidades calibradas em menos de 15 ms, pensado como substituto direto local.

  • simple-jev507★Reprodutível

    Transforme qualquer modelo aberto em um classificador ou em um endpoint compatível.

  • AnyJev440★Reprodutível

    Transforma qualquer LLM em um modelo de decisão: as decisões tipadas e as probabilidades calibradas são lidas das distribuições de prefill do próximo token, sem treinamento.

  • openjev386★Reprodutível

    Um servidor de decisões aberto e compatível com o fornecedor, sobre o DiffusionGemma.

  • decider351★Reprodutível

    Um ajuste fino de um modelo 2B que produz decisões tipadas e probabilidades calibradas numa única passagem.

  • LLM2Jev300★Reprodutível

    Adapta modelos de linguagem locais para motores de decisão estruturada compatíveis, com as três primitivas produzidas por inferência binária apenas com prefill.

  • agent-jev286★Reprodutível

    Uma réplica de 0.6B voltada a agentes: forneça estado não estruturado (diffs, traces, logs) e perguntas estruturadas e receba distribuições calibradas numa única passagem de cerca de 50 ms, sem tokens de saída.

  • openJev-verdict-2.0283★Reprodutível

    Um motor de decisão não autorregressivo calibrado de 151M que, segundo o autor, supera ao mesmo tempo o modelo do fornecedor e o Laya num benchmark público: 77.10% de precisão, 0.0636 de Brier, 0.0144 de ECE.

  • jev-visual271★Reprodutível

    Um experimento educacional de inferência no Apple Silicon: contexto compartilhado, pontuação direta dos candidatos e demos visuais locais.

  • jeff238★Reprodutível

    Um substituto direto auto-hospedado.

  • reflex133★Reprodutível

    Um pequeno modelo de decisão aberto: estado mais perguntas tipadas, e probabilidades calibradas de volta.

SDKs e integração

Transformar um julgamento em fluxo de controle comum na sua linguagem, ou integrá-lo a um framework que você já usa. Inclui os SDKs oficiais.

  • eve5,342★Implementado

    O framework de agentes aberto da Vercel, que traz o modelo de decisão como modelo de avaliação padrão no seu caminho experimental evaluate.

  • TypeSafe agent skills2,060★Implementado

    A skill oficial para Claude Code, Codex e agentes compatíveis: as primitivas, os padrões e como estruturar avaliações.

  • ai-cli813★Implementado

    Um CLI de terminal da Vercel Labs que pode executar o modelo de decisão como modelo de avaliação do seu comando evaluate.

  • jev-mcp (jkudish)320★Implementado

    Um servidor MCP de prova de conceito para conectar o modelo de decisão a clientes MCP.

  • typesafe-mcp292★Implementado

    Um servidor MCP em Go de binário único que expõe julgamentos tipados ao Claude Desktop, Claude Code e Codex.

  • System One adapter (Python)287★Implementado

    O substituto direto do cliente oficial: você troca o cliente e, por trás, ele se conecta à OpenAI, à Anthropic ou a APIs de LLM compatíveis — serve para comparar o modelo de decisão com modelos de chat na mesma avaliação.

  • TypeSafe JavaScript SDK232★Implementado

    O cliente oficial de TypeScript/JavaScript, com tipos de resposta inferidos.

  • TypeSafe Python SDK220★Implementado

    O cliente oficial de Python, nas versões síncrona e assíncrona.

Aplicações e experimentos

Coisas feitas para uma pessoa usar diretamente: trading, busca, escrita, matar uma ideia.

  • jev-trader2,240★Implementado

    Uma decisão de trading a cada bloco da Monad.

  • shapeshift491★Implementado

    Uma entrada que vira o que você quer dizer: uma caixa de texto que se transforma na interface certa conforme você digita. Funciona offline.

  • JevRev304★Implementado

    Um fluxo de trabalho de LLM + modelo de decisão. (A descrição pública não vai além disso.)

  • jev-align (Sutro)284★Implementado

    Um CLI de aprendizado ativo que usa rótulos humanos e GEPA para melhorar como as decisões são definidas.

  • killmyidea159★Implementado

    Descreva sua ideia de startup e ele decide: matar, consertar ou lançar.

  • jev-trade131★Implementado

    Um trader em tempo real guiado por decisões na Hyperliquid.