Skip to content
OpenAgentsbeta
openagents/eval-harness

Agent Eval Harness

HarnessFree

Build a real eval suite for an agent or prompt: cases, graders, a baseline, and a regression gate

v1.0.0MIT2 downloads
npx openagents-cli add openagents/eval-harness --runtime claude-code
schema1
nameeval-harness
owneropenagents
version1.0.0
kindharness
licenseMIT
entryHARNESS.md
runtimesclaude-code, codex, openai-agents, langgraph, generic
tagsevals, testing, harness, regression, quality
capabilities
pricingfree

Inputs

NameTypeRequiredDescription
targetstringYesWhat is being evaluated: a prompt file, an agent entry point, or a graph node
n_casesnumberNoHow many cases to build before measuring a baseline

Keyboard shortcuts

Focus search
/
Go to Explore
ge
Go to Home
gh
Go to Tags
gt
Go to Collections
gc
Show this help
?
Close suggestions or this dialog
Esc