Documentación

Lista de proyectos

60 proyectos, organizados según lo que intentas resolver. Una línea para cada uno, con un conteo de estrellas y una fecha de instantánea.

Cómo leer una línea

  • El conteo de estrellas refleja atención y uso, no calidad; la fecha que lo acompaña es cuándo se leyó.
  • El nivel de evidencia (reproducible / implementado) responde a «cuánto se puede comprobar», no a si es bueno. Unas pocas líneas de código que publican resultados en bruto y un proyecto con todas sus funciones cuyos números vienen todos de su autor caen en niveles distintos — y eso no tiene nada que ver con que uno u otro sea útil.

60 proyectos. Los star son de 2026-09-24.

Reproducible
Publica artefactos sin procesar, conjuntos de datos o una evaluación que se puede volver a ejecutar.
Implementado
Código legible con pruebas; las cifras son del propio autor.

Interfaces y navegadores

Donde cada paso es un clic. Las decisiones son tan baratas que se pueden consultar en cada paso.

  • Jev Ultrafast19,456★Implementado

    El agente ultrarrápido de browser-use: el modelo de decisión elige a la vez la operación y el elemento del DOM en una sola solicitud, y solo recurre a un LLM pequeño cuando hay que escribir texto.

  • jev-chat-jarvis5,561★Implementado

    Un copiloto de conversación para el celular: lee a la otra persona en WeChat, QQ, X o Feishu, propone respuestas y las escribe en el cuadro de texto, el envío sigue siendo manual. Solo lee la pantalla, no hace hook ni modifica el paquete.

  • typesafe-computer-use937★Implementado

    Uso del equipo en macOS: hace OCR de la pantalla, clasifica la siguiente acción con el modelo de decisión y hace clic. El autor reporta unos $0.0002 por paso.

  • hermes-jev-skills726★Implementado

    Un conjunto de skills para agentes Hermes que cubre enrutamiento de modelos, memoria, compactación de contexto, selección de skills y uso del equipo o del navegador; también se instala en Claude Code y Codex.

  • jev-browser-use453★Implementado

    Deja que el modelo de decisión elija el clic mientras Codex piensa y verifica; el autor reporta operaciones de navegador entre 5 y 10 veces más rápidas.

  • typesafe-mario383★Implementado

    Un agente que juega a Super Mario Bros. con el estado estructurado que da el emulador en lugar de píxeles.

  • mobile-jev380★Implementado

    Un agente independiente en Android en el que el modelo de decisión toma todas las decisiones, con un estudio en vivo que muestra la telemetría de las decisiones.

  • jev-chat-jarvis-mac346★Implementado

    Una superposición de detección de intención para WeChat (macOS): lee la pantalla y, con un modelo pequeño local, juzga la intención y el riesgo; luego genera respuestas candidatas según el tono. Estrictamente de solo lectura, no inyecta nada en WeChat.

  • jev-voice-browser271★Implementado

    Controla un navegador real con la voz: por cada palabra que dices, la intención y el elemento objetivo se deciden en unos 300 ms y Playwright los ejecuta; a menudo la acción sale antes de que termines la frase.

  • jev-browser257★Implementado

    Uso del navegador impulsado por el modelo de decisión.

  • unclutter227★Implementado

    Una extensión de navegador que usa el modelo de decisión para detectar y eliminar los elementos que estorban en la página, con reglas que se pueden guardar como plantillas y reutilizar.

  • embodied-jev221★Implementado

    Un banco de trabajo de decisiones para robots en MuJoCo.

  • jev-drone170★Implementado

    Un dron autónomo que solo usa cámara en MuJoCo, con el paso de decisión corriendo a 2.5 Hz.

Poner frenos a un agente

La segunda capa de juicio de un agente de programación: dar paso o no, si ya terminó, y qué sigue haciendo falta en el contexto.

  • fast-jev-compaction6,653★Implementado

    Un plugin de Claude Code que cambia «comprimir en un resumen» por «puntuar uno por uno»: en una sola solicitud decide, para cada llamada de herramienta y su resultado, si todavía hace falta; lo obsoleto se descarta o se trunca, y lo que se conserva se mantiene literal.

  • foreman540★Implementado

    Un supervisor de agentes que usa decisiones para que los agentes de programación no se salgan de la tarea.

  • JevHarness191★Implementado

    Hace que un LLM escriba un harness de decisión para una tarea concreta, con reflexión de recompensa sobre toda la trayectoria y evolución con GEPA como opción.

  • jev-dsh-decision163★Implementado

    Un plugin de decisión estructurada para harness de agentes: compatible de forma nativa con DeepSeek Harness y, a través de iPolloWork, también con OpenCode y Codex Harness.

  • jev-pruner144★Implementado

    Un plugin de Claude Code que recorta las salidas largas de Bash antes de que el modelo las vea.

  • pi-jev (y0usaf)144★Implementado

    Una capa de decisión para el agente de programación Pi: una compuerta de llamadas a herramientas medida, más jev_ask para obtener respuestas tipadas y calibradas.

  • pi-warden138★Implementado

    Guardarraíles para Pi que guían en lugar de interrumpir: el modelo de decisión juzga las llamadas a herramientas irreversibles o fuera de tarea, detecta bucles atascados y comprueba los «ya terminé» que en realidad no se verificaron.

  • building-with-jev-skill131★Implementado

    Una skill que enseña a escribir y mejorar programas que llaman al modelo de decisión.

Enrutamiento, búsqueda y revisión de código

Decidir quién se encarga, o elegir cuáles candidatos vale la pena mirar.

  • jev-review (devagrawal09)586★Implementado

    Un flujo de trabajo de revisión de código por etapas, con un panel local.

  • jev-search446★Implementado

    Búsqueda web con el modelo de decisión: selección de fuentes, comprensión de la consulta y ordenación por relevancia.

  • jev-router (gargpratyush)377★Implementado

    Enruta las tareas de Claude Code al modelo suficiente y más barato, haciendo que el modelo de decisión elija entre los candidatos.

  • pg-jev329★Implementado

    Una extensión de PostgreSQL para hacer preguntas a tus tablas en lenguaje sencillo.

  • jev-codex-router263★Implementado

    Enrutamiento turno a turno para Codex: en cada turno se vuelve a decidir el modelo, la profundidad de razonamiento y el modo de velocidad.

  • jev-review (NiazMorshed2007)218★Implementado

    Un plugin MCP local-first que hace que los agentes de programación revisen la calidad del software de forma continua.

  • notra215★Implementado

    Una plataforma de analítica de marketing que trasladó un «clasificador de visibilidad de marca» de un LLM a decisiones booleanas, con un feature flag para controlar el cambio.

  • JevRouter190★Implementado

    Un enrutador ligero que elige entre modelos, herramientas y subagentes.

  • perch171★Implementado

    Una herramienta de línea de comandos que analiza un repositorio y lo convierte en un grafo de llamadas a nivel de método; luego pide al modelo de decisión que señale posibles defectos y revise reglas de proyecto escritas en inglés sencillo.

  • jev-semgrep134★Implementado

    Busca por significado en lugar de por patrón: puntúa cada línea según lo cerca que está de un significado y combina varios significados con AND / OR / NOT.

  • neo4jev129★Implementado

    Recorre un grafo de Neo4j salto a salto: clasifica cada relación de salida candidata y usa beam search sobre las log-probabilidades de la respuesta.

Alternativas locales y abiertas

Pesos abiertos y runtimes locales detrás de la misma interfaz HTTP.

  • SemIf4,162★Reproducible

    ifs semánticos con modelos abiertos, en una sola 3090 en casa. Proyecto independiente, sin relación con el proveedor.

  • NanoJev2,159★Reproducible

    Una réplica de 0.6B: decisiones en paralelo sobre candidatos dinámicos, sin generar ningún token de salida, con el pipeline de entrenamiento de extremo a extremo.

  • jevlike1,279★Reproducible

    Entrena un modelo pequeño que elige en una lista de opciones de texto que crece y se acorta, con una probabilidad por opción en una sola pasada; incluye demos de Doom, ajedrez y Wikispeedia.

  • von610★Reproducible

    Un modelo no autorregresivo de 395M que responde preguntas tipadas con probabilidades calibradas en menos de 15 ms, planteado como reemplazo directo local.

  • simple-jev507★Reproducible

    Convierte cualquier modelo abierto en un clasificador o en un endpoint compatible.

  • AnyJev440★Reproducible

    Convierte cualquier LLM en un modelo de decisión: lee las decisiones tipadas y las probabilidades calibradas de la distribución prefill del siguiente token, sin necesidad de entrenamiento.

  • openjev386★Reproducible

    Un servidor de decisiones abierto y compatible, montado sobre DiffusionGemma.

  • decider351★Reproducible

    Un ajuste fino de un modelo de 2B que produce decisiones tipadas y probabilidades calibradas en una sola pasada.

  • LLM2Jev300★Reproducible

    Adapta modelos de lenguaje locales para convertirlos en motores de decisión estructurada compatibles, con las tres primitivas producidas por inferencia binaria solo con prefill.

  • agent-jev286★Reproducible

    Una réplica de 0.6B pensada para agentes: le das estado sin estructura (diffs, traces, logs) y preguntas estructuradas, y devuelve distribuciones calibradas en una sola pasada de unos 50 ms, sin generar tokens de salida.

  • openJev-verdict-2.0283★Reproducible

    Un motor de decisión no autorregresivo de 151M que, según su autor, supera a la vez al modelo del proveedor y a Laya en un benchmark público: 77.10% de precisión, 0.0636 de Brier y 0.0144 de ECE.

  • jev-visual271★Reproducible

    Un experimento de inferencia educativo en Apple Silicon: contexto compartido, puntuación directa de candidatos y demos visuales locales.

  • jeff238★Reproducible

    Un reemplazo directo autoalojado.

  • reflex133★Reproducible

    Un modelo de decisión abierto y pequeño: estado más preguntas tipadas, y devuelve probabilidades calibradas.

SDK e integración

Convertir un juicio en flujo de control normal en tu lenguaje, o integrarlo en un framework que ya usas. Incluye los SDK oficiales.

  • eve5,342★Implementado

    El framework de agentes abierto de Vercel, que incluye el modelo de decisión como modelo de evaluación predeterminado en su ruta experimental evaluate.

  • TypeSafe agent skills2,060★Implementado

    La skill oficial para Claude Code, Codex y agentes compatibles: las primitivas, los patrones y cómo estructurar las evaluaciones.

  • ai-cli813★Implementado

    Una CLI de terminal de Vercel Labs que puede ejecutar el modelo de decisión como modelo de evaluación de su comando evaluate.

  • jev-mcp (jkudish)320★Implementado

    Un servidor MCP de prueba de concepto para conectar el modelo de decisión con clientes MCP.

  • typesafe-mcp292★Implementado

    Un servidor MCP en Go de un solo binario que expone juicios tipados a Claude Desktop, Claude Code y Codex.

  • System One adapter (Python)287★Implementado

    El adaptador de reemplazo directo oficial: cambias el cliente y por detrás se conecta a OpenAI, Anthropic o APIs de LLM compatibles; sirve para comparar el modelo de decisión con modelos de chat en la misma evaluación.

  • TypeSafe JavaScript SDK232★Implementado

    El cliente oficial de TypeScript/JavaScript, con tipos de respuesta inferidos.

  • TypeSafe Python SDK220★Implementado

    El cliente oficial de Python, en versiones síncrona y asíncrona.

Aplicaciones y experimentos

Cosas hechas para que una persona las use directamente: trading, búsqueda, escritura, condenar una idea.

  • jev-trader2,240★Implementado

    Una decisión de trading en cada bloque de Monad.

  • shapeshift491★Implementado

    Un campo de entrada que se convierte en lo que quieres decir: un cuadro de texto que se transforma en la interfaz adecuada a medida que escribes. Funciona sin conexión.

  • JevRev304★Implementado

    Un flujo de trabajo de «LLM + modelo de decisión». (La descripción pública no dice nada más.)

  • jev-align (Sutro)284★Implementado

    Una CLI de aprendizaje activo que usa etiquetas humanas y GEPA para mejorar cómo se definen las decisiones.

  • killmyidea159★Implementado

    Describe tu idea de startup y decide: matarla, arreglarla o lanzarla.

  • jev-trade131★Implementado

    Un trader en vivo guiado por decisiones sobre Hyperliquid.