Lista de proyectos
60 proyectos, organizados según lo que intentas resolver. Una línea para cada uno, con un conteo de estrellas y una fecha de instantánea.
Cómo leer una línea
- El conteo de estrellas refleja atención y uso, no calidad; la fecha que lo acompaña es cuándo se leyó.
- El nivel de evidencia (reproducible / implementado) responde a «cuánto se puede comprobar», no a si es bueno. Unas pocas líneas de código que publican resultados en bruto y un proyecto con todas sus funciones cuyos números vienen todos de su autor caen en niveles distintos — y eso no tiene nada que ver con que uno u otro sea útil.
60 proyectos. Los star son de 2026-09-24.
- Reproducible
- Publica artefactos sin procesar, conjuntos de datos o una evaluación que se puede volver a ejecutar.
- Implementado
- Código legible con pruebas; las cifras son del propio autor.
Interfaces y navegadores
Donde cada paso es un clic. Las decisiones son tan baratas que se pueden consultar en cada paso.
Jev Ultrafast19,456★Implementado
El agente ultrarrápido de browser-use: el modelo de decisión elige a la vez la operación y el elemento del DOM en una sola solicitud, y solo recurre a un LLM pequeño cuando hay que escribir texto.
jev-chat-jarvis5,561★Implementado
Un copiloto de conversación para el celular: lee a la otra persona en WeChat, QQ, X o Feishu, propone respuestas y las escribe en el cuadro de texto, el envío sigue siendo manual. Solo lee la pantalla, no hace hook ni modifica el paquete.
typesafe-computer-use937★Implementado
Uso del equipo en macOS: hace OCR de la pantalla, clasifica la siguiente acción con el modelo de decisión y hace clic. El autor reporta unos $0.0002 por paso.
hermes-jev-skills726★Implementado
Un conjunto de skills para agentes Hermes que cubre enrutamiento de modelos, memoria, compactación de contexto, selección de skills y uso del equipo o del navegador; también se instala en Claude Code y Codex.
jev-browser-use453★Implementado
Deja que el modelo de decisión elija el clic mientras Codex piensa y verifica; el autor reporta operaciones de navegador entre 5 y 10 veces más rápidas.
typesafe-mario383★Implementado
Un agente que juega a Super Mario Bros. con el estado estructurado que da el emulador en lugar de píxeles.
mobile-jev380★Implementado
Un agente independiente en Android en el que el modelo de decisión toma todas las decisiones, con un estudio en vivo que muestra la telemetría de las decisiones.
jev-chat-jarvis-mac346★Implementado
Una superposición de detección de intención para WeChat (macOS): lee la pantalla y, con un modelo pequeño local, juzga la intención y el riesgo; luego genera respuestas candidatas según el tono. Estrictamente de solo lectura, no inyecta nada en WeChat.
jev-voice-browser271★Implementado
Controla un navegador real con la voz: por cada palabra que dices, la intención y el elemento objetivo se deciden en unos 300 ms y Playwright los ejecuta; a menudo la acción sale antes de que termines la frase.
jev-browser257★Implementado
Uso del navegador impulsado por el modelo de decisión.
unclutter227★Implementado
Una extensión de navegador que usa el modelo de decisión para detectar y eliminar los elementos que estorban en la página, con reglas que se pueden guardar como plantillas y reutilizar.
embodied-jev221★Implementado
Un banco de trabajo de decisiones para robots en MuJoCo.
jev-drone170★Implementado
Un dron autónomo que solo usa cámara en MuJoCo, con el paso de decisión corriendo a 2.5 Hz.
Poner frenos a un agente
La segunda capa de juicio de un agente de programación: dar paso o no, si ya terminó, y qué sigue haciendo falta en el contexto.
fast-jev-compaction6,653★Implementado
Un plugin de Claude Code que cambia «comprimir en un resumen» por «puntuar uno por uno»: en una sola solicitud decide, para cada llamada de herramienta y su resultado, si todavía hace falta; lo obsoleto se descarta o se trunca, y lo que se conserva se mantiene literal.
foreman540★Implementado
Un supervisor de agentes que usa decisiones para que los agentes de programación no se salgan de la tarea.
JevHarness191★Implementado
Hace que un LLM escriba un harness de decisión para una tarea concreta, con reflexión de recompensa sobre toda la trayectoria y evolución con GEPA como opción.
jev-dsh-decision163★Implementado
Un plugin de decisión estructurada para harness de agentes: compatible de forma nativa con DeepSeek Harness y, a través de iPolloWork, también con OpenCode y Codex Harness.
jev-pruner144★Implementado
Un plugin de Claude Code que recorta las salidas largas de Bash antes de que el modelo las vea.
pi-jev (y0usaf)144★Implementado
Una capa de decisión para el agente de programación Pi: una compuerta de llamadas a herramientas medida, más
jev_askpara obtener respuestas tipadas y calibradas.pi-warden138★Implementado
Guardarraíles para Pi que guían en lugar de interrumpir: el modelo de decisión juzga las llamadas a herramientas irreversibles o fuera de tarea, detecta bucles atascados y comprueba los «ya terminé» que en realidad no se verificaron.
building-with-jev-skill131★Implementado
Una skill que enseña a escribir y mejorar programas que llaman al modelo de decisión.
Enrutamiento, búsqueda y revisión de código
Decidir quién se encarga, o elegir cuáles candidatos vale la pena mirar.
jev-review (devagrawal09)586★Implementado
Un flujo de trabajo de revisión de código por etapas, con un panel local.
jev-search446★Implementado
Búsqueda web con el modelo de decisión: selección de fuentes, comprensión de la consulta y ordenación por relevancia.
jev-router (gargpratyush)377★Implementado
Enruta las tareas de Claude Code al modelo suficiente y más barato, haciendo que el modelo de decisión elija entre los candidatos.
pg-jev329★Implementado
Una extensión de PostgreSQL para hacer preguntas a tus tablas en lenguaje sencillo.
jev-codex-router263★Implementado
Enrutamiento turno a turno para Codex: en cada turno se vuelve a decidir el modelo, la profundidad de razonamiento y el modo de velocidad.
jev-review (NiazMorshed2007)218★Implementado
Un plugin MCP local-first que hace que los agentes de programación revisen la calidad del software de forma continua.
notra215★Implementado
Una plataforma de analítica de marketing que trasladó un «clasificador de visibilidad de marca» de un LLM a decisiones booleanas, con un feature flag para controlar el cambio.
JevRouter190★Implementado
Un enrutador ligero que elige entre modelos, herramientas y subagentes.
perch171★Implementado
Una herramienta de línea de comandos que analiza un repositorio y lo convierte en un grafo de llamadas a nivel de método; luego pide al modelo de decisión que señale posibles defectos y revise reglas de proyecto escritas en inglés sencillo.
jev-semgrep134★Implementado
Busca por significado en lugar de por patrón: puntúa cada línea según lo cerca que está de un significado y combina varios significados con AND / OR / NOT.
neo4jev129★Implementado
Recorre un grafo de Neo4j salto a salto: clasifica cada relación de salida candidata y usa beam search sobre las log-probabilidades de la respuesta.
Alternativas locales y abiertas
Pesos abiertos y runtimes locales detrás de la misma interfaz HTTP.
SemIf4,162★Reproducible
ifs semánticos con modelos abiertos, en una sola 3090 en casa. Proyecto independiente, sin relación con el proveedor.
NanoJev2,159★Reproducible
Una réplica de 0.6B: decisiones en paralelo sobre candidatos dinámicos, sin generar ningún token de salida, con el pipeline de entrenamiento de extremo a extremo.
jevlike1,279★Reproducible
Entrena un modelo pequeño que elige en una lista de opciones de texto que crece y se acorta, con una probabilidad por opción en una sola pasada; incluye demos de Doom, ajedrez y Wikispeedia.
von610★Reproducible
Un modelo no autorregresivo de 395M que responde preguntas tipadas con probabilidades calibradas en menos de 15 ms, planteado como reemplazo directo local.
simple-jev507★Reproducible
Convierte cualquier modelo abierto en un clasificador o en un endpoint compatible.
AnyJev440★Reproducible
Convierte cualquier LLM en un modelo de decisión: lee las decisiones tipadas y las probabilidades calibradas de la distribución prefill del siguiente token, sin necesidad de entrenamiento.
openjev386★Reproducible
Un servidor de decisiones abierto y compatible, montado sobre DiffusionGemma.
decider351★Reproducible
Un ajuste fino de un modelo de 2B que produce decisiones tipadas y probabilidades calibradas en una sola pasada.
LLM2Jev300★Reproducible
Adapta modelos de lenguaje locales para convertirlos en motores de decisión estructurada compatibles, con las tres primitivas producidas por inferencia binaria solo con prefill.
agent-jev286★Reproducible
Una réplica de 0.6B pensada para agentes: le das estado sin estructura (diffs, traces, logs) y preguntas estructuradas, y devuelve distribuciones calibradas en una sola pasada de unos 50 ms, sin generar tokens de salida.
openJev-verdict-2.0283★Reproducible
Un motor de decisión no autorregresivo de 151M que, según su autor, supera a la vez al modelo del proveedor y a Laya en un benchmark público: 77.10% de precisión, 0.0636 de Brier y 0.0144 de ECE.
jev-visual271★Reproducible
Un experimento de inferencia educativo en Apple Silicon: contexto compartido, puntuación directa de candidatos y demos visuales locales.
jeff238★Reproducible
Un reemplazo directo autoalojado.
reflex133★Reproducible
Un modelo de decisión abierto y pequeño: estado más preguntas tipadas, y devuelve probabilidades calibradas.
SDK e integración
Convertir un juicio en flujo de control normal en tu lenguaje, o integrarlo en un framework que ya usas. Incluye los SDK oficiales.
eve5,342★Implementado
El framework de agentes abierto de Vercel, que incluye el modelo de decisión como modelo de evaluación predeterminado en su ruta experimental evaluate.
TypeSafe agent skills2,060★Implementado
La skill oficial para Claude Code, Codex y agentes compatibles: las primitivas, los patrones y cómo estructurar las evaluaciones.
ai-cli813★Implementado
Una CLI de terminal de Vercel Labs que puede ejecutar el modelo de decisión como modelo de evaluación de su comando
evaluate.jev-mcp (jkudish)320★Implementado
Un servidor MCP de prueba de concepto para conectar el modelo de decisión con clientes MCP.
typesafe-mcp292★Implementado
Un servidor MCP en Go de un solo binario que expone juicios tipados a Claude Desktop, Claude Code y Codex.
System One adapter (Python)287★Implementado
El adaptador de reemplazo directo oficial: cambias el cliente y por detrás se conecta a OpenAI, Anthropic o APIs de LLM compatibles; sirve para comparar el modelo de decisión con modelos de chat en la misma evaluación.
TypeSafe JavaScript SDK232★Implementado
El cliente oficial de TypeScript/JavaScript, con tipos de respuesta inferidos.
TypeSafe Python SDK220★Implementado
El cliente oficial de Python, en versiones síncrona y asíncrona.
Aplicaciones y experimentos
Cosas hechas para que una persona las use directamente: trading, búsqueda, escritura, condenar una idea.
jev-trader2,240★Implementado
Una decisión de trading en cada bloque de Monad.
shapeshift491★Implementado
Un campo de entrada que se convierte en lo que quieres decir: un cuadro de texto que se transforma en la interfaz adecuada a medida que escribes. Funciona sin conexión.
JevRev304★Implementado
Un flujo de trabajo de «LLM + modelo de decisión». (La descripción pública no dice nada más.)
jev-align (Sutro)284★Implementado
Una CLI de aprendizaje activo que usa etiquetas humanas y GEPA para mejorar cómo se definen las decisiones.
killmyidea159★Implementado
Describe tu idea de startup y decide: matarla, arreglarla o lanzarla.
jev-trade131★Implementado
Un trader en vivo guiado por decisiones sobre Hyperliquid.