Documentação

Lista de projetos

60 projetos, organizados por aquilo que tentas resolver. Uma linha para cada, com um número de estrelas e uma data de captura.

Como ler uma linha

  • O número de estrelas reflete atenção e utilização, não qualidade; a data ao lado é quando foi lido.
  • O nível de evidência (reprodutível / implementado) responde a «quanto é possível verificar», não a se é bom. Umas poucas linhas de código que publicam resultados em bruto e um projeto completo em funcionalidades cujos números vêm todos do próprio autor ficam em níveis diferentes — e isso não tem nada a ver com o facto de qualquer um deles ser útil.

60 projetos. As estrelas são de 2026-09-24.

Reprodutível
Publica artefactos brutos, conjuntos de dados ou uma avaliação que pode ser executada novamente.
Implementado
Código legível com testes; os números são do próprio autor.

Interfaces e navegadores

Cenas em que cada passo é um clique. As decisões são baratas o suficiente para perguntar a cada passo.

  • Jev Ultrafast19,456★Implementado

    O agente ultrarrápido do Browser Use: o modelo de decisão escolhe ao mesmo tempo a operação e o elemento do DOM num único pedido, e um LLM pequeno só é chamado quando é preciso escrever texto.

  • jev-chat-jarvis5,561★Implementado

    Um copiloto de conversa no telemóvel: lê a outra pessoa no WeChat, QQ, X ou Feishu, propõe respostas e preenche a caixa de texto — o envio continua manual. Lê apenas o ecrã, não faz hook nem altera o pacote.

  • typesafe-computer-use937★Implementado

    Uso do computador no macOS: faz OCR do ecrã, classifica a ação seguinte com o modelo de decisão e clica. O autor indica cerca de $0.0002 por passo.

  • hermes-jev-skills726★Implementado

    Um conjunto de skills para agentes Hermes: encaminhamento de modelos, memória, compactação de contexto, seleção de skills e uso do computador ou do navegador — também se instala no Claude Code e no Codex.

  • jev-browser-use453★Implementado

    Deixa o modelo de decisão escolher o clique enquanto o Codex pensa e verifica — operações de navegador indicadas 5–10× mais rápidas.

  • typesafe-mario383★Implementado

    Um agente que joga Super Mario Bros. a partir do estado estruturado do emulador em vez de píxeis.

  • mobile-jev380★Implementado

    Um agente Android autónomo em que o modelo de decisão toma todas as decisões, com um estúdio em direto que mostra a telemetria das decisões.

  • jev-chat-jarvis-mac346★Implementado

    Uma sobreposição de deteção de intenção para o WeChat (macOS): leitura do ecrã e um modelo pequeno local para avaliar intenção e risco, depois respostas candidatas — estritamente só de leitura, nada é injetado no WeChat.

  • jev-voice-browser271★Implementado

    Controlar um navegador real por voz: a intenção e o alvo são decididos em cerca de 300 ms por palavra dita, e o Playwright executa — muitas vezes antes de terminares a frase.

  • jev-browser257★Implementado

    Uso do navegador orientado pelo modelo de decisão.

  • unclutter227★Implementado

    Uma extensão de navegador que usa o modelo de decisão para encontrar e remover o que atulha a página, com regras que podem ser guardadas como modelos reutilizáveis.

  • embodied-jev221★Implementado

    Uma bancada de decisão para robôs no MuJoCo.

  • jev-drone170★Implementado

    Um drone autónomo apenas com câmara em MuJoCo, com a etapa de decisão a correr a 2.5 Hz.

Pôr travões num agente

A segunda camada de julgamento de um agente de programação: deixar passar ou não, se está concluído, o que ainda é preciso no contexto.

  • fast-jev-compaction6,653★Implementado

    Um plugin do Claude Code que substitui o resumo de compactação por decisões: cada chamada de ferramenta e o respetivo resultado são avaliados num único pedido, o que está obsoleto é descartado ou truncado, e o que é mantido permanece à letra.

  • foreman540★Implementado

    Um supervisor de agentes que usa decisões para manter os agentes de programação na tarefa.

  • JevHarness191★Implementado

    Harnesses de decisão específicos de cada tarefa escritos por um LLM, com reflexão da recompensa ao longo de toda a trajetória e evolução por GEPA como opção.

  • jev-dsh-decision163★Implementado

    Um plugin de decisão estruturada para harnesses de agentes: nativo no DeepSeek Harness e, através do iPolloWork, também OpenCode e Codex Harness.

  • jev-pruner144★Implementado

    Um plugin do Claude Code que corta as saídas longas do Bash antes de o modelo as ver.

  • pi-jev (y0usaf)144★Implementado

    Uma camada de decisão para o agente de programação Pi: um portão de chamadas de ferramentas medido mais jev_ask para respostas tipadas e calibradas.

  • pi-warden138★Implementado

    Guardrails para o Pi que orientam em vez de interromper: o modelo de decisão avalia chamadas de ferramenta irreversíveis ou fora da tarefa, deteta ciclos presos e verifica declarações de conclusão não comprovadas.

  • building-with-jev-skill131★Implementado

    Uma skill para escrever e melhorar programas que chamam o modelo de decisão.

Roteamento, pesquisa e revisão

Decidir quem trata disso, ou escolher entre os candidatos quais vale a pena ver.

  • jev-review (devagrawal09)586★Implementado

    Um fluxo de revisão de código por etapas, com um painel local.

  • jev-search446★Implementado

    Pesquisa na web com o modelo de decisão: seleção de fontes, compreensão da consulta e ordenação por relevância.

  • jev-router (gargpratyush)377★Implementado

    Encaminha as tarefas do Claude Code para o modelo suficiente e mais barato, pedindo ao modelo de decisão que escolha entre os candidatos.

  • pg-jev329★Implementado

    Uma extensão do PostgreSQL para fazer perguntas às tuas tabelas em linguagem simples.

  • jev-codex-router263★Implementado

    Encaminhamento turno a turno para o Codex: em cada turno volta a decidir o modelo, a profundidade de raciocínio e o modo de velocidade.

  • jev-review (NiazMorshed2007)218★Implementado

    Um plugin MCP local-first para revisão contínua da qualidade de software por agentes de programação.

  • notra215★Implementado

    Uma plataforma de análise de marketing que migrou um classificador de visibilidade de marca de um LLM para decisões booleanas, com a troca controlada por feature flag.

  • JevRouter190★Implementado

    Um router leve para modelos, ferramentas e subagentes.

  • perch171★Implementado

    Uma CLI que analisa um repositório num grafo de chamadas ao nível de método e depois pede ao modelo de decisão que sinalize defeitos prováveis e verifique regras de projeto escritas em inglês simples.

  • jev-semgrep134★Implementado

    Grep por significado em vez de padrão: cada linha é pontuada em relação a um significado, e os significados combinam-se com AND / OR / NOT.

  • neo4jev129★Implementado

    Percorre um grafo Neo4j salto a salto, classificando cada aresta de saída candidata, com beam search sobre as log-probabilidades da resposta.

Alternativas locais e abertas

Pesos abertos e runtimes locais por trás da mesma interface HTTP.

  • SemIf4,162★Reprodutível

    ifs semânticos a partir de modelos abertos, numa única 3090 em casa. Independente, sem ligação ao fornecedor.

  • NanoJev2,159★Reprodutível

    Uma réplica de 0.6B: decisões em paralelo sobre candidatos dinâmicos, sem descodificar qualquer token de saída, com o pipeline de treino de ponta a ponta.

  • jevlike1,279★Reprodutível

    Treina um modelo pequeno que escolhe numa lista de opções de texto que cresce e encolhe, com uma probabilidade por opção numa única passagem — com demos de Doom, xadrez e Wikispeedia.

  • von610★Reprodutível

    Um modelo não autorregressivo de 395M que responde a perguntas tipadas com probabilidades calibradas em menos de 15 ms, pensado como substituto direto local.

  • simple-jev507★Reprodutível

    Transforma qualquer modelo aberto num classificador ou num endpoint compatível.

  • AnyJev440★Reprodutível

    Transforma qualquer LLM num modelo de decisão: as decisões tipadas e as probabilidades calibradas são lidas das distribuições de prefill do token seguinte, sem treino.

  • openjev386★Reprodutível

    Um servidor de decisões aberto e compatível com o fornecedor, assente em DiffusionGemma.

  • decider351★Reprodutível

    Um ajuste fino de um modelo 2B que produz decisões tipadas e probabilidades calibradas numa única passagem.

  • LLM2Jev300★Reprodutível

    Adapta modelos de linguagem locais para motores de decisão estruturada compatíveis, com as três primitivas produzidas por inferência binária apenas com prefill.

  • agent-jev286★Reprodutível

    Uma réplica de 0.6B destinada a agentes: dá-lhe estado não estruturado (diffs, traces, logs) e perguntas estruturadas e recebes distribuições calibradas numa única passagem de cerca de 50 ms, sem tokens de saída.

  • openJev-verdict-2.0283★Reprodutível

    Um motor de decisão não autorregressivo calibrado de 151M que, segundo o autor, supera ao mesmo tempo o modelo do fornecedor e o Laya num benchmark público: 77.10% de precisão, 0.0636 de Brier, 0.0144 de ECE.

  • jev-visual271★Reprodutível

    Uma experiência educativa de inferência em Apple Silicon: contexto partilhado, pontuação direta dos candidatos e demos visuais locais.

  • jeff238★Reprodutível

    Um substituto direto auto-alojado.

  • reflex133★Reprodutível

    Um pequeno modelo de decisão aberto: estado mais perguntas tipadas, e probabilidades calibradas de volta.

SDKs e integração

Transformar um julgamento em fluxo de controlo normal na tua linguagem, ou integrá-lo num framework que já usas. Inclui os SDK oficiais.

  • eve5,342★Implementado

    O framework de agentes aberto da Vercel, que inclui o modelo de decisão como modelo de avaliação predefinido no seu percurso experimental evaluate.

  • TypeSafe agent skills2,060★Implementado

    A skill oficial para Claude Code, Codex e agentes compatíveis: as primitivas, os padrões e como estruturar avaliações.

  • ai-cli813★Implementado

    Uma CLI de terminal da Vercel Labs que pode executar o modelo de decisão como modelo de avaliação do seu comando evaluate.

  • jev-mcp (jkudish)320★Implementado

    Um servidor MCP de prova de conceito para ligar o modelo de decisão a clientes MCP.

  • typesafe-mcp292★Implementado

    Um servidor MCP em Go, num único binário, que expõe juízos tipados ao Claude Desktop, Claude Code e Codex.

  • System One adapter (Python)287★Implementado

    O substituto direto do cliente oficial: trocas o cliente e, por trás, liga-se à OpenAI, à Anthropic ou a APIs de LLM compatíveis — serve para comparar o modelo de decisão com modelos de chat na mesma avaliação.

  • TypeSafe JavaScript SDK232★Implementado

    O cliente oficial de TypeScript/JavaScript, com tipos de resposta inferidos.

  • TypeSafe Python SDK220★Implementado

    O cliente oficial de Python, nas versões síncrona e assíncrona.

Aplicações e experimentos

Coisas feitas para uma pessoa usar diretamente: trading, pesquisa, escrita, matar uma ideia.

  • jev-trader2,240★Implementado

    Uma decisão de trading a cada bloco da Monad.

  • shapeshift491★Implementado

    Uma entrada que se torna naquilo que queres dizer: uma caixa de texto que se transforma na interface certa à medida que escreves. Funciona offline.

  • JevRev304★Implementado

    Um fluxo de trabalho de LLM + modelo de decisão. (A descrição pública não vai além disto.)

  • jev-align (Sutro)284★Implementado

    Uma CLI de aprendizagem ativa que usa rótulos humanos e GEPA para melhorar a forma como as decisões são definidas.

  • killmyidea159★Implementado

    Descreve a tua ideia de startup e ele decide: matar, corrigir ou lançar.

  • jev-trade131★Implementado

    Um trader em tempo real guiado por decisões na Hyperliquid.