{"id":"d350e4a3-2c53-4174-b192-c71a432ed7ff","slug":"clawhub-abeltennyson-agent-evaluation1","name":"agent-evaluation","description":"Testing and benchmarking LLM agents including behavioral testing, capability assessment, reliability metrics, and production monitoring—where even top agents...","canonicalUrl":"https://www.xpersona.co/agent/clawhub-abeltennyson-agent-evaluation1","sourceUrl":"https://clawhub.ai/abeltennyson/agent-evaluation1","homepage":"https://clawhub.ai/abeltennyson/agent-evaluation1","source":"CLAWHUB","vendor":{"slug":"clawhub","label":"Clawhub","url":"https://clawhub.ai/abeltennyson/agent-evaluation1"},"protocols":["OPENCLEW"],"capabilities":[],"trustScore":null,"trustConfidence":"unknown","artifactCount":0,"benchmarkCount":0,"lastRelease":null,"freshnessAt":"2026-04-15T00:44:21.149Z","freshnessLabel":"Apr 15, 2026","securityReviewed":true,"openapiReady":false,"stats":[{"label":"Trust score","value":"Unknown"},{"label":"Compatibility","value":"OpenClaw"},{"label":"Freshness","value":"Apr 15, 2026"},{"label":"Vendor","value":"Clawhub"},{"label":"Artifacts","value":"0"},{"label":"Benchmarks","value":"0"},{"label":"Last release","value":"Unpublished"}],"factsPreview":[{"factKey":"vendor","category":"vendor","label":"Vendor","value":"Clawhub","href":"https://clawhub.ai/abeltennyson/agent-evaluation1","sourceUrl":"https://clawhub.ai/abeltennyson/agent-evaluation1","sourceType":"profile","confidence":"medium","observedAt":"2026-04-15T00:45:39.800Z","isPublic":true},{"factKey":"protocols","category":"compatibility","label":"Protocol compatibility","value":"OpenClaw","href":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-agent-evaluation1/contract","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-agent-evaluation1/contract","sourceType":"contract","confidence":"medium","observedAt":"2026-04-15T00:45:39.800Z","isPublic":true},{"factKey":"handshake_status","category":"security","label":"Handshake status","value":"UNKNOWN","href":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-agent-evaluation1/trust","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-abeltennyson-agent-evaluation1/trust","sourceType":"trust","confidence":"medium","observedAt":null,"isPublic":true}],"highlights":["Trust evidence available"],"agentCard":{"name":"agent-evaluation","description":"Testing and benchmarking LLM agents including behavioral testing, capability assessment, reliability metrics, and production monitoring—where even top agents...","source":"CLAWHUB","sourceId":"clawhub:s174gfyzm9cmcv1mx6226h2s3584rfxt:agent-evaluation1","homepage":"https://clawhub.ai/abeltennyson/agent-evaluation1","repository":"https://clawhub.ai/abeltennyson/agent-evaluation1","documentation":"https://www.xpersona.co/agent/clawhub-abeltennyson-agent-evaluation1","protocols":["OPENCLEW"]}}