119,506 packages matching “evaluation-framework”
deepeval
v0.9.10 · 10 days ago
The LLM Evaluation Framework for TypeScript
No known vulnerabilities
@outputai/evals
v0.11.0 · 7 days ago
Offline evaluation framework for Output.ai workflows
No known vulnerabilities
vieval
v0.0.12 · 1 month ago
Vitest-based evaluation framework for agents, models, and more.
No known vulnerabilities
@fabric-harness/evals
v2.1.1 · 21 days ago
Evaluation framework for Fabric Harness agents.
No known vulnerabilities
viteval
v0.5.9 · 4 months ago
Next generation LLM evaluation framework powered by Vitest.
No known vulnerabilities
@viteval/core
v0.5.9 · 4 months ago
Core - Next generation LLM evaluation framework powered by Vitest.
No known vulnerabilities
@agentprodready/evaluation
v1.0.1 · 11 days ago
**Evaluation framework — score and compare agent runs with replaceable evaluators.**
No known vulnerabilities
@axlsdk/eval
v0.20.1 · 16 days ago
Evaluation framework for Axl agentic workflows
No known vulnerabilities
@aikdna/kdna-eval
v0.3.2 · 1 month ago
KDNA consumption evaluation framework — configurable scoring, multi-gate gating, replay regression, and cost tracking.
No known vulnerabilities
webmcp-evals
v0.0.3 · 1 month ago
Evaluation framework and CLI for WebMCP tools and agentic workflows
No known vulnerabilities
@gleanwork/mcp-server-tester
v1.1.1 · 1 month ago
Playwright-based testing and evaluation framework for MCP servers
No known vulnerabilities
@nestjs-agentic/evaluation
v1.0.0 · 1 day ago
Automated agent benchmarking, trajectory scoring, and LLM-as-a-Judge evaluation framework for nestjs-agentic.
No known vulnerabilities
@agentesting/agentest
v0.0.22 · 2 months ago
Embedded agent simulation & evaluation framework for Node.js/TypeScript
No known vulnerabilities
@orq-ai/evaluatorq
v1.3.2 · 3 months ago
Evaluation framework with Effect-based architecture for running parallel AI evaluations
No known vulnerabilities
@viteval/cli
v0.5.9 · 4 months ago
Command line interface for Viteval - Next generation LLM evaluation framework powered by Vitest.
No known vulnerabilities
@cogitator-ai/evals
v0.1.12 · 24 days ago
Evaluation framework for Cogitator AI agents
No known vulnerabilities
orchestrated
v0.1.33 · 1 month ago
LLM evaluation framework with batch processing and data sources
No known vulnerabilities
@forwardimpact/libeval
v0.1.66 · 1 month ago
Agent evaluation framework — prove whether agent changes improved outcomes with reproducible evidence.
No known vulnerabilities
@reactive-agents/eval
v0.15.0 · 3 days ago
Evaluation framework for Reactive Agents — LLM-as-judge scoring, regression detection, dataset loading
No known vulnerabilities
@sanity/agent-evals
v0.0.6 · 4 months ago
Vitest-style evaluation framework for Sanity Agent
No known vulnerabilities