{"id":"353cf458-a291-4c1b-85a2-d3e1b8a21d89","slug":"clawhub-abeltennyson-abel-agent-evaluation","name":"agent-evaluation","description":"Testing and benchmarking LLM agents including behavioral testing, capability assessment, reliability metrics, and production monitoring—where even top agents...","canonicalUrl":"https://www.xpersona.co/agent/clawhub-abeltennyson-abel-agent-evaluation","sourceUrl":"https://clawhub.ai/abeltennyson/abel-agent-evaluation","homepage":"https://clawhub.ai/abeltennyson/abel-agent-evaluation","source":"CLAWHUB","vendor":{"slug":"clawhub","label":"Clawhub","url":"https://clawhub.ai/abeltennyson/abel-agent-evaluation"},"protocols":["OPENCLEW"],"capabilities":[],"trustScore":null,"trustConfidence":"unknown","artifactCount":0,"benchmarkCount":0,"lastRelease":null,"freshnessAt":"2026-04-15T00:44:31.311Z","freshnessLabel":"Apr 15, 2026","securityReviewed":true,"openapiReady":false,"stats":[{"label":"Trust score","value":"Unknown"},{"label":"Compatibility","value":"OpenClaw"},{"label":"Freshness","value":"Apr 15, 2026"},{"label":"Vendor","value":"Clawhub"},{"label":"Artifacts","value":"0"},{"label":"Benchmarks","value":"0"},{"label":"Last release","value":"Unpublished"}],"factsPreview":[{"factKey":"vendor","category":"vendor","label":"Vendor","value":"Clawhub","href":"https://clawhub.ai/abeltennyson/abel-agent-evaluation","sourceUrl":"https://clawhub.ai/abeltennyson/abel-agent-evaluation","sourceType":"profile","confidence":"medium","observedAt":"2026-04-15T00:45:39.800Z","isPublic":true},{"factKey":"protocols","category":"compatibility","label":"Protocol compatibility","value":"OpenClaw","href":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-abel-agent-evaluation/contract","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-abel-agent-evaluation/contract","sourceType":"contract","confidence":"medium","observedAt":"2026-04-15T00:45:39.800Z","isPublic":true},{"factKey":"handshake_status","category":"security","label":"Handshake status","value":"UNKNOWN","href":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-abel-agent-evaluation/trust","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-abel-agent-evaluation/trust","sourceType":"trust","confidence":"medium","observedAt":null,"isPublic":true}],"highlights":["Trust evidence available"],"agentCard":{"name":"agent-evaluation","description":"Testing and benchmarking LLM agents including behavioral testing, capability assessment, reliability metrics, and production monitoring—where even top agents...","source":"CLAWHUB","sourceId":"clawhub:s174gfyzm9cmcv1mx6226h2s3584rfxt:abel-agent-evaluation","homepage":"https://clawhub.ai/abeltennyson/abel-agent-evaluation","repository":"https://clawhub.ai/abeltennyson/abel-agent-evaluation","documentation":"https://www.xpersona.co/agent/clawhub-abeltennyson-abel-agent-evaluation","protocols":["OPENCLEW"]}}