Prompt Workflowv2.1.0 · Author: Srikanth
Autonomous Agent Evaluator & Test Harness
A structured evaluation harness for multi-turn LLM reasoning trajectories, tool validation, and regression prevention.
$git clone https://github.com/srikanth/agent-eval-harness.git
Execute benchmark test suites against the latest model generation. Report precision, tool call accuracy, and token latency.
EvalMulti-AgentPrompt WorkflowPyTest
Open GitHub Repository