{"id":"68d3317d-02ed-4ceb-a8b5-fea515070d98","slug":"clawhub-edonadei-evaluate-skill","name":"evaluate-skill","description":"Measure a skill's reliability — run it k times for a pass@k score, design or interpret its eval, or compare it against the base agent. Use when the user wants to run, design, or interpret a skill's eval, or write an .eval.yaml spec.","canonicalUrl":"https://www.xpersona.co/agent/clawhub-edonadei-evaluate-skill","sourceUrl":"https://clawhub.ai/edonadei/evaluate-skill","homepage":"https://clawhub.ai/edonadei/skills/evaluate-skill","source":"CLAWHUB","vendor":{"slug":"clawhub","label":"Clawhub","url":"https://clawhub.ai/edonadei/skills/evaluate-skill"},"protocols":["OPENCLEW"],"capabilities":[],"trustScore":null,"trustConfidence":"unknown","artifactCount":0,"benchmarkCount":0,"lastRelease":"1.0.14","freshnessAt":"2026-10-11T02:16:22.344Z","freshnessLabel":"Oct 11, 2026","securityReviewed":true,"openapiReady":false,"stats":[{"label":"Trust score","value":"Unknown"},{"label":"Compatibility","value":"OpenClaw"},{"label":"Freshness","value":"Oct 11, 2026"},{"label":"Vendor","value":"Clawhub"},{"label":"Artifacts","value":"0"},{"label":"Benchmarks","value":"0"},{"label":"Last release","value":"1.0.14"}],"factsPreview":[{"factKey":"vendor","category":"vendor","label":"Vendor","value":"Clawhub","href":"https://clawhub.ai/edonadei/skills/evaluate-skill","sourceUrl":"https://clawhub.ai/edonadei/skills/evaluate-skill","sourceType":"profile","confidence":"medium","observedAt":"2026-10-11T02:16:22.404Z","isPublic":true},{"factKey":"protocols","category":"compatibility","label":"Protocol compatibility","value":"OpenClaw","href":"https://www.xpersona.co/api/v1/agents/clawhub-edonadei-evaluate-skill/contract","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-edonadei-evaluate-skill/contract","sourceType":"contract","confidence":"medium","observedAt":"2026-10-11T02:16:22.404Z","isPublic":true},{"factKey":"traction","category":"adoption","label":"Adoption signal","value":"1.2K downloads","href":"https://clawhub.ai/edonadei/evaluate-skill","sourceUrl":"https://clawhub.ai/edonadei/evaluate-skill","sourceType":"profile","confidence":"medium","observedAt":"2026-10-11T02:16:22.404Z","isPublic":true},{"factKey":"latest_release","category":"release","label":"Latest release","value":"1.0.14","href":"https://clawhub.ai/edonadei/evaluate-skill","sourceUrl":"https://clawhub.ai/edonadei/evaluate-skill","sourceType":"release","confidence":"medium","observedAt":"2026-09-25T15:12:56.018Z","isPublic":true},{"factKey":"handshake_status","category":"security","label":"Handshake status","value":"UNKNOWN","href":"https://www.xpersona.co/api/v1/agents/clawhub-edonadei-evaluate-skill/trust","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-edonadei-evaluate-skill/trust","sourceType":"trust","confidence":"medium","observedAt":null,"isPublic":true}],"highlights":["1.2K downloads","Trust evidence available"],"agentCard":{"name":"evaluate-skill","description":"Measure a skill's reliability — run it k times for a pass@k score, design or interpret its eval, or compare it against the base agent. Use when the user wants to run, design, or interpret a skill's eval, or write an .eval.yaml spec.","source":"CLAWHUB","sourceId":"clawhub:s17fhassds1tss1zjq6jkjcfd983rjwt:evaluate-skill","homepage":"https://clawhub.ai/edonadei/skills/evaluate-skill","repository":"https://clawhub.ai/edonadei/evaluate-skill","documentation":"https://www.xpersona.co/agent/clawhub-edonadei-evaluate-skill","protocols":["OPENCLEW"],"examples":[{"kind":"example","language":"bash","snippet":"pipx install caliper-eval"},{"kind":"example","language":"yaml","snippet":"skill:\n  path: ./SKILL.md      # relative to the spec file\ntasks:\n  - name: What success looks like\n    prompt: <prompt sent to the skill under test>\n    expect: <natural-language pass/fail criterion>\n    assert: |           # optional deterministic Python check\n      assert ..."}]}}