Liste de projets
60 projets, organisés selon ce que tu cherches à résoudre. Une ligne chacun, avec un nombre d’étoiles et une date d’instantané.
Comment lire une ligne
- Le nombre d’étoiles reflète l’attention et l’usage, pas la qualité ; la date à côté indique quand il a été relevé.
- Le niveau de preuve (reproductible / implémenté) répond à « combien peut-on vérifier », pas si c’est bon. Quelques lignes de code qui publient des résultats bruts et un projet complet dont tous les chiffres viennent de son auteur se situent à des niveaux différents — et cela n’a rien à voir avec l’utilité de l’un ou de l’autre.
60 projets. Les étoiles datent du 2026-09-24.
- Reproductible
- Publie des artefacts bruts, des jeux de données ou une évaluation réexécutable.
- Implémenté
- Du code lisible avec des tests ; les chiffres viennent de l’auteur lui-même.
Interfaces et navigateurs
Des scènes où chaque étape est un clic. Les décisions sont assez bon marché pour être demandées à chaque étape.
Jev Ultrafast19,456★Implémenté
L’agent ultra-rapide de Browser Use : le modèle de décision choisit à la fois l’opération et l’élément du DOM en une seule requête, et un petit LLM n’est appelé que lorsqu’il faut saisir du texte.
jev-chat-jarvis5,561★Implémenté
Un copilote de conversation côté téléphone : lit l’interlocuteur dans WeChat, QQ, X ou Feishu, propose des réponses et remplit le champ de saisie — l’envoi reste manuel. Il lit seulement l’écran, ne hook rien ni ne modifie le paquet.
typesafe-computer-use937★Implémenté
Utilisation de l’ordinateur sur macOS : OCR de l’écran, classification de l’action suivante avec le modèle de décision, clic. Annoncé à environ $0.0002 par étape.
hermes-jev-skills726★Implémenté
Une suite de skills pour les agents Hermes : routage de modèles, mémoire, compaction du contexte, sélection de skills et usage de l’ordinateur ou du navigateur — s’installe aussi sous Claude Code et Codex.
jev-browser-use453★Implémenté
Laisse le modèle de décision choisir le clic pendant que Codex réfléchit et vérifie — opérations de navigateur annoncées 5–10× plus rapides.
typesafe-mario383★Implémenté
Un agent qui joue à Super Mario Bros. à partir de l’état structuré de l’émulateur plutôt que des pixels.
mobile-jev380★Implémenté
Un agent Android autonome où le modèle de décision prend chaque décision, avec un studio en direct affichant la télémétrie des décisions.
jev-chat-jarvis-mac346★Implémenté
Une superposition de détection d’intention pour WeChat (macOS) : lecture de l’écran et petit modèle local pour juger l’intention et le risque, puis des réponses candidates — strictement en lecture seule, rien n’est injecté dans WeChat.
jev-voice-browser271★Implémenté
Contrôler un vrai navigateur à la voix : l’intention et la cible sont décidées en environ 300 ms par mot prononcé, puis Playwright agit — souvent avant que tu aies fini ta phrase.
jev-browser257★Implémenté
Usage du navigateur piloté par le modèle de décision.
unclutter227★Implémenté
Une extension de navigateur qui utilise le modèle de décision pour repérer et supprimer l’encombrement des pages, avec des règles réutilisables sous forme de modèles.
embodied-jev221★Implémenté
Un atelier de décision pour robots sous MuJoCo.
jev-drone170★Implémenté
Un drone autonome doté d’une seule caméra dans MuJoCo, avec l’étape de décision tournant à 2.5 Hz.
Mettre des freins à un agent
La deuxième couche de jugement d’un agent de codage : laisser passer ou non, est-ce terminé, que garder encore dans le contexte.
fast-jev-compaction6,653★Implémenté
Un plugin Claude Code qui remplace le résumé de compaction par des décisions : chaque appel d’outil et son résultat sont notés dans une seule requête, l’obsolète est supprimé ou tronqué, et ce qui est gardé reste mot pour mot.
foreman540★Implémenté
Un superviseur d’agents qui utilise des décisions pour ramener les agents de codage à la tâche.
JevHarness191★Implémenté
Des harness de décision spécifiques à une tâche rédigés par un LLM, avec en option une réflexion sur la récompense de toute la trajectoire et une évolution par GEPA.
jev-dsh-decision163★Implémenté
Un plugin de décision structurée pour les harness d’agents : natif sur DeepSeek Harness et, via iPolloWork, aussi OpenCode et Codex Harness.
jev-pruner144★Implémenté
Un plugin Claude Code qui coupe les longues sorties Bash avant même que le modèle ne les voie.
pi-jev (y0usaf)144★Implémenté
Une couche de décision pour l’agent de codage Pi : un portail d’appels d’outils mesuré plus
jev_askpour des réponses typées et calibrées.pi-warden138★Implémenté
Des garde-fous pour Pi qui guident au lieu d’interrompre : le modèle de décision juge les appels d’outils irréversibles ou hors sujet, détecte les boucles bloquées et vérifie les affirmations de fin non vérifiées.
building-with-jev-skill131★Implémenté
Une skill pour écrire et améliorer les programmes qui appellent le modèle de décision.
Routage, recherche et revue
Décider qui s’en occupe, ou choisir parmi les candidats ceux qui valent la peine d’être regardés.
jev-review (devagrawal09)586★Implémenté
Un flux de revue de code par étapes, avec un tableau de bord local.
jev-search446★Implémenté
Recherche web avec le modèle de décision : sélection des sources, compréhension de la requête et classement par pertinence.
jev-router (gargpratyush)377★Implémenté
Route les tâches de Claude Code vers le modèle suffisant et le moins cher, en demandant au modèle de décision de choisir parmi les candidats.
pg-jev329★Implémenté
Une extension PostgreSQL pour interroger tes tables en langage courant.
jev-codex-router263★Implémenté
Routage tour par tour pour Codex : chaque tour re-décide le modèle, la profondeur de réflexion et le mode de vitesse.
jev-review (NiazMorshed2007)218★Implémenté
Un plugin MCP local-first pour une revue continue de la qualité logicielle par les agents de codage.
notra215★Implémenté
Une plateforme d’analytique marketing qui a déplacé un classifieur de visibilité de marque d’un LLM vers des décisions booléennes, activable par un feature flag.
JevRouter190★Implémenté
Un routeur léger pour les modèles, les outils et les sous-agents.
perch171★Implémenté
Un CLI qui analyse un dépôt en graphe d’appels au niveau des méthodes, puis demande au modèle de décision de signaler les défauts probables et de vérifier des règles de projet écrites en anglais simple.
jev-semgrep134★Implémenté
Grep par sens plutôt que par motif : chaque ligne est notée par rapport à un sens, et les sens se combinent avec AND / OR / NOT.
neo4jev129★Implémenté
Parcourt un graphe Neo4j saut par saut en classifiant chaque relation sortante candidate, avec une recherche par faisceau sur les log-probabilités de la réponse.
Alternatives locales et ouvertes
Des poids ouverts et des runtimes locaux derrière la même interface HTTP.
SemIf4,162★Reproductible
Des if sémantiques à partir de modèles ouverts, sur une seule 3090 à la maison. Indépendant, sans lien avec le fournisseur.
NanoJev2,159★Reproductible
Une réplique de 0.6B : des décisions parallèles sur des candidats dynamiques, aucun décodage de jetons de sortie, avec le pipeline d’entraînement de bout en bout.
jevlike1,279★Reproductible
Entraîne un petit modèle qui choisit dans une liste d’options textuelles qui change, avec une probabilité par option en une seule passe — avec des démos de Doom, d’échecs et de Wikispeedia.
von610★Reproductible
Un modèle non autorégressif de 395M qui répond à des questions typées avec des probabilités calibrées en moins de 15 ms, conçu comme remplacement direct local.
simple-jev507★Reproductible
Transforme n’importe quel modèle ouvert en classifieur, ou en endpoint compatible.
AnyJev440★Reproductible
Transforme n’importe quel LLM en modèle de décision : les décisions typées et les probabilités calibrées se lisent dans les distributions de prefill du jeton suivant, sans entraînement.
openjev386★Reproductible
Un serveur de décision ouvert et compatible avec le fournisseur, bâti sur DiffusionGemma.
decider351★Reproductible
Un ajustement d’un modèle 2B qui produit des décisions typées et des probabilités calibrées en une seule passe.
LLM2Jev300★Reproductible
Adapte des modèles de langage locaux en moteurs de décision structurée compatibles, les trois primitives étant produites par inférence binaire avec prefill uniquement.
agent-jev286★Reproductible
Une réplique de 0.6B destinée aux agents : donne-lui un état non structuré (diffs, traces, logs) et des questions structurées, et elle rend des distributions calibrées en une seule passe d’environ 50 ms, sans jetons de sortie.
openJev-verdict-2.0283★Reproductible
Un moteur de décision non autorégressif calibré de 151M que son auteur dit battre à la fois le modèle du fournisseur et Laya sur un benchmark public : 77.10% de précision, 0.0636 de Brier, 0.0144 d’ECE.
jev-visual271★Reproductible
Une expérience d’inférence pédagogique sur Apple Silicon : contexte partagé, notation directe des candidats et démos visuelles locales.
jeff238★Reproductible
Un remplacement direct auto-hébergé.
reflex133★Reproductible
Un petit modèle de décision ouvert : état plus questions typées, et des probabilités calibrées en retour.
SDK et intégration
Transformer un jugement en flux de contrôle ordinaire dans ton langage, ou l’intégrer dans un framework que tu utilises déjà. Inclut les SDK officiels.
eve5,342★Implémenté
Le framework d’agents ouvert de Vercel, qui embarque le modèle de décision comme modèle d’évaluation par défaut dans son chemin expérimental evaluate.
TypeSafe agent skills2,060★Implémenté
La skill officielle pour Claude Code, Codex et les agents compatibles : les primitives, les motifs et comment structurer les évaluations.
ai-cli813★Implémenté
Un CLI de terminal de Vercel Labs qui peut exécuter le modèle de décision comme modèle d’évaluation pour sa commande
evaluate.jev-mcp (jkudish)320★Implémenté
Un serveur MCP de preuve de concept pour connecter le modèle de décision aux clients MCP.
typesafe-mcp292★Implémenté
Un serveur MCP en Go, un seul binaire, qui expose des jugements typés à Claude Desktop, Claude Code et Codex.
System One adapter (Python)287★Implémenté
Le remplacement direct du client officiel : tu changes le client, et derrière il se connecte à OpenAI, Anthropic ou à des API LLM compatibles — pour comparer le modèle de décision aux modèles de chat dans la même évaluation.
TypeSafe JavaScript SDK232★Implémenté
Le client officiel TypeScript/JavaScript, avec des types de réponse inférés.
TypeSafe Python SDK220★Implémenté
Le client Python officiel, synchrone et asynchrone.
Applications et expériences
Des choses faites pour être utilisées directement : trading, recherche, écriture, tuer une idée.
jev-trader2,240★Implémenté
Une décision de trading à chaque bloc Monad.
shapeshift491★Implémenté
Une entrée qui devient ce que tu veux dire : une zone de texte qui se transforme en interface adaptée au fil de la frappe. Fonctionne hors ligne.
JevRev304★Implémenté
Un flux de travail « LLM + modèle de décision ». (La description publique ne va pas plus loin.)
jev-align (Sutro)284★Implémenté
Un CLI d’apprentissage actif qui utilise des étiquettes humaines et GEPA pour améliorer la définition des décisions.
killmyidea159★Implémenté
Décris ton idée de startup et il décide : la tuer, la corriger ou la lancer.
jev-trade131★Implémenté
Un trader en direct piloté par les décisions sur Hyperliquid.