771 packages matching “Evaluations”
@cortex-js/compute-engine
v0.117.0 · 11 hours ago
Symbolic computing and numeric evaluations for JavaScript and Node.js
No known vulnerabilities
@arizeai/phoenix-evals
v2.2.0 · 17 days ago
A library for running evaluations for AI use cases
No known vulnerabilities
@effectionx/scope-eval
v0.1.3 · 5 months ago
Evaluate operations in a scope while retaining resources across evaluations
No known vulnerabilities
@universis/evaluations
v1.0.42 · 2 months ago
Universis evaluations library
No known vulnerabilities
scoundrel-remote-eval
v1.0.34 · 3 months ago
JavaScript client for running remote evaluations with Scoundrel.
No known vulnerabilities
@twin.org/rights-management-pip-service
v0.9.1 · 25 days ago
Policy information point service for supplying context facts to evaluations.
No known vulnerabilities
@droyd/cli
v0.1.21 · 24 days ago
Command-line interface for Droyd research competitions and evaluations
No known vulnerabilities
@microsoft/m365-copilot-eval
v1.16.0 · 11 hours ago
Zero-config Node.js wrapper for M365 Copilot Agent Evaluations CLI (Python-based Azure AI Evaluation SDK)
No known vulnerabilities
@dynatrace-oss/dt-eval-lib
v0.0.17-alpha · 20 hours ago
Minimal TypeScript library for running LLM-as-a-judge evaluations
No known vulnerabilities
@arnilo/prism-evals
v0.3.0 · 9 hours ago
Bounded deterministic, trace, model-judge, pairwise, and CI evaluations for Prism runs.
No known vulnerabilities
@evalguard/cli
v3.8.1 · 1 day ago
EvalGuard CLI - Run LLM evaluations and security scans from the command line
No known vulnerabilities
@swarmx/cli
v3.2.0 · 26 days ago
Command-line interface for SwarmX workflows and evaluations.
No known vulnerabilities
@ignitionai/agent-trainer-evals
v0.1.0-alpha.1 · 1 month ago
Reward functions and trace helpers for Ignition Agent Trainer evaluations.
No known vulnerabilities
@orq-ai/evaluatorq
v1.3.2 · 3 months ago
Evaluation framework with Effect-based architecture for running parallel AI evaluations
No known vulnerabilities
architectonic-models
v0.3.0 · 1 month ago
Evidence-backed model metadata, evaluations, capability requirements, and routing policy.
No known vulnerabilities
@langwatch/server
v3.15.0 · 1 day ago
Run LangWatch locally with one command — `npx @langwatch/server`. Complete LangWatch stack: observability, evaluations, AI gateway, agent simulations.
No known vulnerabilities
self-bench
v0.3.5 · 4 days ago
Turn completed repository changes into durable, private Harbor evaluations
No known vulnerabilities
@concord-consortium/compute-engine
v0.12.3-cc.2 · 3 years ago
Symbolic computing and numeric evaluations for JavaScript and Node.js
No known vulnerabilities
@driftgard/agent-observer
v1.5.0 · 9 days ago
Observe AI coding agents and send prompt/response evaluations to DriftGard.
No known vulnerabilities
@moesi/fork-bundler
v0.7.0 · 1 month ago
Deliberately minimal EntryPoint 0.7 bundler for Moesi's local Anvil fork evaluations.
No known vulnerabilities