{"id":"0e38c6b4-1800-4265-ab89-0a36ac3f4faf","slug":"crewai-mahammadriyazshek-crewai-llm-evaluation-framework","name":"crewai-llm-evaluation-framework","description":"Custom CrewAI multi-agent framework that automates LLM response quality evaluation against rubrics — replacing manual human review with a scalable system achieving 79% accuracy. Topics: crewai llm-evaluation multi-agent azure-openai langchain","canonicalUrl":"https://www.xpersona.co/agent/crewai-mahammadriyazshek-crewai-llm-evaluation-framework","sourceUrl":"https://github.com/MahammadRiyazShek/crewai-llm-evaluation-framework","homepage":null,"source":"GITHUB_REPOS","vendor":{"slug":"mahammadriyazshek","label":"Mahammadriyazshek","url":"https://github.com/MahammadRiyazShek/crewai-llm-evaluation-framework"},"protocols":["OPENCLEW"],"capabilities":["crewai","multi-agent"],"trustScore":null,"trustConfidence":"unknown","artifactCount":0,"benchmarkCount":0,"lastRelease":null,"freshnessAt":"2026-10-09T20:22:13.627Z","freshnessLabel":"Oct 9, 2026","securityReviewed":true,"openapiReady":false,"stats":[{"label":"Trust score","value":"Unknown"},{"label":"Compatibility","value":"OpenClaw"},{"label":"Freshness","value":"Oct 9, 2026"},{"label":"Vendor","value":"Mahammadriyazshek"},{"label":"Artifacts","value":"0"},{"label":"Benchmarks","value":"0"},{"label":"Last release","value":"Unpublished"}],"factsPreview":[{"factKey":"vendor","category":"vendor","label":"Vendor","value":"Mahammadriyazshek","href":"https://github.com/MahammadRiyazShek/crewai-llm-evaluation-framework","sourceUrl":"https://github.com/MahammadRiyazShek/crewai-llm-evaluation-framework","sourceType":"profile","confidence":"medium","observedAt":"2026-10-09T20:22:13.632Z","isPublic":true},{"factKey":"protocols","category":"compatibility","label":"Protocol compatibility","value":"OpenClaw","href":"https://www.xpersona.co/api/v1/agents/crewai-mahammadriyazshek-crewai-llm-evaluation-framework/contract","sourceUrl":"https://www.xpersona.co/api/v1/agents/crewai-mahammadriyazshek-crewai-llm-evaluation-framework/contract","sourceType":"contract","confidence":"medium","observedAt":"2026-10-09T20:22:13.632Z","isPublic":true},{"factKey":"docs_crawl","category":"integration","label":"Crawlable docs","value":"6 indexed pages on the official domain","href":"https://github.com/login?return_to=https%3A%2F%2Fgithub.com%2Fopenclaw%2Fskills%2Ftree%2Fmain%2Fskills%2Fasleep123%2Fcaldav-calendar","sourceUrl":"https://github.com/login?return_to=https%3A%2F%2Fgithub.com%2Fopenclaw%2Fskills%2Ftree%2Fmain%2Fskills%2Fasleep123%2Fcaldav-calendar","sourceType":"search_document","confidence":"medium","observedAt":"2026-04-15T05:03:46.393Z","isPublic":true},{"factKey":"handshake_status","category":"security","label":"Handshake status","value":"UNKNOWN","href":"https://www.xpersona.co/api/v1/agents/crewai-mahammadriyazshek-crewai-llm-evaluation-framework/trust","sourceUrl":"https://www.xpersona.co/api/v1/agents/crewai-mahammadriyazshek-crewai-llm-evaluation-framework/trust","sourceType":"trust","confidence":"medium","observedAt":null,"isPublic":true}],"highlights":["Trust evidence available"],"agentCard":{"name":"crewai-llm-evaluation-framework","description":"Custom CrewAI multi-agent framework that automates LLM response quality evaluation against rubrics — replacing manual human review with a scalable system achieving 79% accuracy. Topics: crewai llm-evaluation multi-agent azure-openai langchain","source":"GITHUB_REPOS","sourceId":"crewai:1255962413","repository":"https://github.com/MahammadRiyazShek/crewai-llm-evaluation-framework","documentation":"https://www.xpersona.co/agent/crewai-mahammadriyazshek-crewai-llm-evaluation-framework","protocols":["OPENCLEW"],"capabilities":["crewai","multi-agent"],"languages":["python"],"install":{"command":"git clone https://github.com/MahammadRiyazShek/crewai-llm-evaluation-framework.git","ecosystem":"git"},"examples":[{"kind":"example","language":"bash","snippet":"pip install -r requirements.txt\nexport AZURE_OPENAI_API_KEY=...\nexport AZURE_OPENAI_ENDPOINT=https://YOUR.openai.azure.com/\nexport CHAT_DEPLOYMENT=gpt-4\nuvicorn crewai_eval:app --reload"}]}}