2,066 packages matching “Judge”
@tagma/completion-llm-judge
v0.2.93 · 3 days ago
LLM-as-judge completion plugin for tagma-sdk pipelines
No known vulnerabilities
jupyterlab-judge
v1.31.0 · 7 days ago
A simple online judge for Jupyter Lab.
No known vulnerabilities
@rulvar/evals
v1.248.0 · 4 hours ago
Rulvar evals: eval cases, golden outputs, rubric and judge graders, matrix sweeps, canary fingerprint.
No known vulnerabilities
@gotgenes/pi-permission-model-judge
v1.1.4 · 2 days ago
Deny-first typo-path model judge — a pi-permission-system Authorizer chain link
No known vulnerabilities
@crewhaus/eval-judge
v0.5.7 · 3 days ago
LLM-as-judge grader with prompt-injection defense and structured tool-use output
No known vulnerabilities
opencode-tamer-judge
v1.1.0 · 20 days ago
LLM-powered judge for opencode - blocks file modifications without explicit user permission
No known vulnerabilities
llm-scorer
v0.1.3 · 12 days ago
A tiny JSONL LLM judge
No known vulnerabilities
agentic-sage
v1.3.1 · 24 days ago
Passive fleet judge for parallel AI coding agent sessions (Claude Code, Grok Build CLI, etc.) — board, territory, merge briefings, optional live-judge briefs.
No known vulnerabilities
@fabricorg/experiments-evals
v0.2.0 · 1 month ago
LLM and code evaluators for Fabric Experiments: judge library, ModelClient contract, run aggregation.
No known vulnerabilities
@introspection-ai/cli-linux-arm64
v0.30.0 · 1 day ago
linux-arm64 binaries for the Introspection CLI and judge host
No known vulnerabilities
@introspection-ai/cli-darwin-x64
v0.30.0 · 1 day ago
darwin-x64 binaries for the Introspection CLI and judge host
No known vulnerabilities
@introspection-ai/cli-win32-x64
v0.30.0 · 1 day ago
win32-x64 binaries for the Introspection CLI and judge host
No known vulnerabilities
@pwtap/plugin-ai-judge
v0.1.2 · 27 days ago
AI/LLM judge matchers for Playwright — toPassRubric/toScoreAtLeast/toMatchImage over Ollama, OpenAI-compatible endpoints (OpenAI/OpenRouter/NVIDIA/Groq/…), and native Claude
No known vulnerabilities
@skill-harness/core
v0.9.0 · 1 day ago
skill-harness engine — spec, discover, run, LLM-judge grade, score, results (internal API)
No known vulnerabilities
@skill-harness/adapters
v0.9.0 · 1 day ago
skill-harness harness adapters — pi runner + claude-code judge routing (internal API)
No known vulnerabilities
@introspection-ai/cli-darwin-arm64
v0.30.0 · 1 day ago
darwin-arm64 binaries for the Introspection CLI and judge host
No known vulnerabilities
@introspection-ai/cli-linux-x64
v0.30.0 · 1 day ago
linux-x64 binaries for the Introspection CLI and judge host
No known vulnerabilities
@sway11466/holiday-jp-npm
v0.3.3 · 6 months ago
Library to judge Japanese national holidays in nodejs.
No known vulnerabilities
@miracle3010/ai-orchestrator
v0.2.1 · 27 days ago
Plan-code-judge AI orchestration for Pi and Cursor.
No known vulnerabilities
@arnilo/prism-evals
v0.3.0 · 18 hours ago
Bounded deterministic, trace, model-judge, pairwise, and CI evaluations for Prism runs.
No known vulnerabilities