ドキュメント

プロジェクト一覧

60 件のプロジェクトを「何を解決したいか」で分類したものです。 一件につき一行、star 数とスナップショット日付を添えています。

一行の読み方

  • star 数は注目度と使用量であり、品質ではありません。数字の隣の日付は その値を読んだ日です。
  • 証拠の段階(再現可能 / 実装あり)が答えるのは「どこまで検証できるか」であり、 良いかどうかではありません。数行のコードでも生の結果を公開しているものと、 機能は豊富でも数字がすべて作者によるものは、別の段階に落ちます —— それは役に立つかどうかとは関係がありません。

60 件のプロジェクト。star 数は 2026-09-24 時点の値です。

再現可能
生データ・データセット・再実行できる評価を公開している
実装あり
コードが読めてテストもある。数値は作者自身によるもの

画面とブラウザ

一歩ごとに何かをクリックする場面。判断が安いので毎ステップ問える。

  • Jev Ultrafast19,456★実装あり

    browser-use の超高速 agent。操作と DOM 要素を1 回のリクエストで同時に選び、文字入力を要するときだけ小さな LLM を呼ぶ。

  • jev-chat-jarvis5,561★実装あり

    スマホ側の会話副操縦士。WeChat / QQ / X / Feishu で相手を読み、返信候補を出して入力欄に埋める。送信は人が決める。画面を読むだけで、フックも改変もしない。

  • typesafe-computer-use937★実装あり

    macOS でのコンピュータ操作。画面を OCR し、次の行動を意思決定モデルで分類し、クリックする。報告値は1 ステップ約 $0.0002。

  • hermes-jev-skills726★実装あり

    Hermes agent 向けのスキル一式。モデルルーティング、記憶、圧縮、スキル選択、コンピュータとブラウザの操作。Claude Code と Codex にも導入できる。

  • jev-browser-use453★実装あり

    意思決定モデルがクリックを選び、Codex が考えて検証する分業。ブラウザ操作が 5〜10 倍速いと報告されている。

  • typesafe-mario383★実装あり

    スーパーマリオを遊ぶ agent。入力は画面のピクセルではなく、エミュレータが返す構造化された状態。

  • mobile-jev380★実装あり

    Android 上で単体で動く agent。すべての判断を意思決定モデルが行い、判断のテレメトリを流すスタジオ画面も付く。

  • jev-chat-jarvis-mac346★実装あり

    WeChat の意図認識オーバーレイ(macOS)。画面読みとローカルの小モデルで意図とリスクを判断し、返信候補を出す。読み取り専用で、WeChat には何も注入しない。

  • jev-voice-browser271★実装あり

    音声で実ブラウザを操作する。話した語ごとに約 300 ms で意図と対象を決め、Playwright が実行する。文を言い終える前に動くことも多い。

  • jev-browser257★実装あり

    意思決定モデルでブラウザ操作を駆動する。

  • unclutter227★実装あり

    ブラウザ拡張。ページ上の不要物を意思決定モデルで判別して消す。ルールはテンプレートとして再利用できる。

  • embodied-jev221★実装あり

    MuJoCo 上のロボット意思決定ワークベンチ。

  • jev-drone170★実装あり

    MuJoCo 上のカメラのみの自律ドローン。判断は 2.5 Hz で回る。

agent にブレーキをかける

コーディング agent の第二層の判断。通すか、終わったか、文脈に何を残すか。

  • fast-jev-compaction6,653★実装あり

    Claude Code プラグイン。要約による圧縮を「一つずつの採点」に置き換える。1 回のリクエストで各ツール呼び出しと結果に「まだ必要か」を判定し、古いものは捨てるか切り詰め、残すものは逐語で保つ。

  • foreman540★実装あり

    agent の監督役。判断を使ってコーディング agent をタスクに引き戻す。

  • JevHarness191★実装あり

    タスク固有の意思決定 harness を LLM に書かせる。任意で軌跡全体の報酬リフレクションと GEPA による進化を行う。

  • jev-dsh-decision163★実装あり

    agent harness 向けの構造化意思決定プラグイン。DeepSeek Harness をネイティブに、iPolloWork 経由で OpenCode と Codex Harness も支える。

  • jev-pruner144★実装あり

    Claude Code プラグイン。長い Bash 出力を、モデルが見る前に削る。

  • pi-jev (y0usaf)144★実装あり

    Pi コーディング agent の意思決定層。計測済みのツール呼び出しゲートと、型付きで較正された答えを得る jev_ask。

  • pi-warden138★実装あり

    Pi 向けのガードレール。中断ではなく誘導する方針で、不可逆・逸脱したツール呼び出し、スタックしたループ、未検証の完了宣言を判断する。

  • building-with-jev-skill131★実装あり

    意思決定モデルを呼ぶプログラムの書き方と改善のしかたを教えるスキル。

ルーティング・検索・レビュー

誰が処理するかを決める、あるいは候補の中から見るべきものを選ぶ。

  • jev-review (devagrawal09)586★実装あり

    段階を踏むコードレビューのワークフローと、ローカルのダッシュボード。

  • jev-search446★実装あり

    意思決定モデルでウェブ検索を行う。ソース選定、クエリ理解、関連度の順位付け。

  • jev-router (gargpratyush)377★実装あり

    候補の中から選ばせることで、Claude Code のタスクを十分かつ最安のモデルへ振り分ける。

  • pg-jev329★実装あり

    PostgreSQL 拡張。平易な言葉でテーブルに質問できる。

  • jev-codex-router263★実装あり

    Codex のターンごとのルーティング。各ターンでモデル・思考の深さ・速度モードを決め直す。

  • jev-review (NiazMorshed2007)218★実装あり

    local-first の MCP プラグイン。コーディング agent に継続的な品質レビューをさせる。

  • notra215★実装あり

    マーケティング分析基盤。ブランド露出の分類器を LLM から意思決定モデルの真偽判断へ移し、feature flag で切り替える。

  • JevRouter190★実装あり

    モデル・ツール・サブ agent を振り分ける軽量ルータ。

  • perch171★実装あり

    リポジトリをメソッド単位の呼び出しグラフに解析し、ありそうな欠陥を示させ、平易な英語で書いたプロジェクト規則を検査させる CLI。

  • jev-semgrep134★実装あり

    パターンではなく意味で grep する。各行を意味に対して採点し、複数の意味を AND / OR / NOT で組み合わせる。

  • neo4jev129★実装あり

    Neo4j のグラフを一歩ずつ辿る。候補となる出辺を分類し、答えの対数確率に対してビームサーチを行う。

ローカルとオープンな代替

同じ HTTP インターフェースの裏にあるオープン重みとローカル実行環境。

  • SemIf4,162★再現可能

    自宅の 3090 一枚で意味的な if を回す。オープンモデルを意思決定モデルに作り替える。独立したプロジェクト。

  • NanoJev2,159★再現可能

    0.6B の複製。並列の判断と可変の候補、出力トークンを一切生成しない。学習パイプラインも公開。

  • jevlike1,279★再現可能

    変動する選択肢リストから選ばせる小さなモデルを訓練する。1 回の前方計算で各選択肢に確率を出す。Doom・チェス・Wikispeedia のデモつき。

  • von610★再現可能

    395M の非自己回帰モデル。15 ms 未満で型付きの答えと較正済み確率を返し、ローカルでの差し替えを狙う。

  • simple-jev507★再現可能

    任意のオープンモデルを分類器に、あるいは互換エンドポイントにする。

  • AnyJev440★再現可能

    任意の LLM を意思決定モデルにする。次のトークンの prefill 分布から型付きの判断と較正済み確率を読み取る。学習は不要。

  • openjev386★再現可能

    DiffusionGemma 上に載せた、互換のオープンな意思決定サーバ。

  • decider351★再現可能

    2B モデルの微調整による、1 回の前方計算での型付き判断と較正済み確率。

  • LLM2Jev300★再現可能

    ローカルの言語モデルを互換の構造化意思決定エンジンにする。三つのプリミティブの出力は prefill のみの二値推論で得る。

  • agent-jev286★再現可能

    agent 向けの 0.6B の複製。diff・trace・ログのような非構造化の状態と構造化された質問を入れると、約 50 ms の前方計算 1 回で較正済み分布が返る。出力トークンは生成しない。

  • openJev-verdict-2.0283★再現可能

    151M の非自己回帰の意思決定エンジン。公開ベンチマークで公式モデルと Laya の両方に勝ったと作者は報告する(精度 77.10%、Brier 0.0636、ECE 0.0144)。

  • jev-visual271★再現可能

    Apple Silicon 上の教育用の推論実験。共有コンテキスト、候補への直接採点、ローカルの可視化デモ。

  • jeff238★再現可能

    セルフホストの代替実装。

  • reflex133★再現可能

    小さなオープンの意思決定モデル。状態と型付きの質問から較正済み確率を得る。

SDK と接続

判断を自分の言語の普通の制御フローに、あるいは既に使っているフレームワークに載せる。公式 SDK も含む。

  • eve5,342★実装あり

    Vercel のオープンな agent フレームワーク。実験的な evaluate 経路で、意思決定モデルを既定の評価モデルとして同梱する。

  • TypeSafe agent skills2,060★実装あり

    公式の agent スキル。Claude Code・Codex と互換 agent 向けに、プリミティブ、パターン、そして評価の組み方を扱う。

  • ai-cli813★実装あり

    Vercel Labs のターミナル CLI。evaluate コマンドの評価モデルとして意思決定モデルを走らせられる。

  • jev-mcp (jkudish)320★実装あり

    MCP の概念実証。意思決定モデルを MCP クライアントに接続する。

  • typesafe-mcp292★実装あり

    Go 製の単一バイナリの MCP サーバ。型付きの判断を Claude Desktop・Claude Code・Codex に公開する。

  • System One adapter (Python)287★実装あり

    公式の差し替えアダプタ。クライアントを置き換え、背後を OpenAI・Anthropic などの互換 API にする。意思決定モデルとチャットモデルを同じ評価で比べるためのもの。

  • TypeSafe JavaScript SDK232★実装あり

    公式の TypeScript/JavaScript クライアント。戻り値の型が推論される。

  • TypeSafe Python SDK220★実装あり

    公式の Python クライアント。同期と非同期の両方。

アプリと実験

人に使ってもらうために作られたもの。取引、検索、執筆、アイデアの判定。

  • jev-trader2,240★実装あり

    Monad のブロックごとに 1 回の取引判断。

  • shapeshift491★実装あり

    入力が意味に合わせて姿を変える。打つにつれてテキストボックスが適切な UI に育つ。オフラインでも動く。

  • JevRev304★実装あり

    LLM と意思決定モデルを組み合わせたワークフロー。(公開されている説明はここまでで、これ以上の記述はない。)

  • jev-align (Sutro)284★実装あり

    能動学習で判断の定義を改善する CLI。人によるラベルをフィードバックに使い、GEPA で「問い方」を反復改善する。

  • killmyidea159★実装あり

    スタートアップのアイデアを書くと、判断を下す。捨てるか、直すか、進めるか。

  • jev-trade131★実装あり

    Hyperliquid で実際に動く、判断による取引。