{"id":"1af0e1ee-403b-4d62-87f0-7c6e5871fdd9","slug":"clawhub-skills-1kalin-afrexai-web-scraping-engine","name":"Web Scraping & Data Extraction Engine","description":"Complete web scraping methodology — legal compliance, architecture design, anti-detection, data pipelines, and production operations. Use when building scrapers, extracting web data, monitoring competitors, or automating data collection at scale.","canonicalUrl":"https://www.xpersona.co/agent/clawhub-skills-1kalin-afrexai-web-scraping-engine","sourceUrl":"https://github.com/openclaw/skills/tree/main/skills/1kalin/afrexai-web-scraping-engine","homepage":null,"source":"CLAWHUB","vendor":{"slug":"openclaw","label":"Openclaw","url":"https://github.com/openclaw/skills/tree/main/skills/1kalin/afrexai-web-scraping-engine"},"protocols":["OPENCLEW"],"capabilities":["change","scrape"],"trustScore":null,"trustConfidence":"unknown","artifactCount":0,"benchmarkCount":0,"lastRelease":null,"freshnessAt":"2026-02-25T05:53:01.942Z","freshnessLabel":"Feb 25, 2026","securityReviewed":true,"openapiReady":false,"stats":[{"label":"Trust score","value":"Unknown"},{"label":"Compatibility","value":"OpenClaw"},{"label":"Freshness","value":"Feb 25, 2026"},{"label":"Vendor","value":"Openclaw"},{"label":"Artifacts","value":"0"},{"label":"Benchmarks","value":"0"},{"label":"Last release","value":"Unpublished"}],"factsPreview":[{"factKey":"docs_crawl","category":"integration","label":"Crawlable docs","value":"6 indexed pages on the official domain","href":"https://github.com/login?return_to=https%3A%2F%2Fgithub.com%2Fopenclaw%2Fskills%2Ftree%2Fmain%2Fskills%2Fasleep123%2Fcaldav-calendar","sourceUrl":"https://github.com/login?return_to=https%3A%2F%2Fgithub.com%2Fopenclaw%2Fskills%2Ftree%2Fmain%2Fskills%2Fasleep123%2Fcaldav-calendar","sourceType":"search_document","confidence":"medium","observedAt":"2026-04-15T05:03:46.393Z","isPublic":true},{"factKey":"vendor","category":"vendor","label":"Vendor","value":"Openclaw","href":"https://github.com/openclaw/skills/tree/main/skills/1kalin/afrexai-web-scraping-engine","sourceUrl":"https://github.com/openclaw/skills/tree/main/skills/1kalin/afrexai-web-scraping-engine","sourceType":"profile","confidence":"medium","observedAt":"2026-04-15T00:45:39.800Z","isPublic":true},{"factKey":"protocols","category":"compatibility","label":"Protocol compatibility","value":"OpenClaw","href":"https://www.xpersona.co/api/v1/agents/clawhub-skills-1kalin-afrexai-web-scraping-engine/contract","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-skills-1kalin-afrexai-web-scraping-engine/contract","sourceType":"contract","confidence":"medium","observedAt":"2026-04-15T00:45:39.800Z","isPublic":true},{"factKey":"handshake_status","category":"security","label":"Handshake status","value":"UNKNOWN","href":"https://www.xpersona.co/api/v1/agents/clawhub-skills-1kalin-afrexai-web-scraping-engine/trust","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-skills-1kalin-afrexai-web-scraping-engine/trust","sourceType":"trust","confidence":"medium","observedAt":null,"isPublic":true}],"highlights":["Trust evidence available"],"agentCard":{"name":"Web Scraping & Data Extraction Engine","description":"Complete web scraping methodology — legal compliance, architecture design, anti-detection, data pipelines, and production operations. Use when building scrapers, extracting web data, monitoring competitors, or automating data collection at scale.","source":"CLAWHUB","sourceId":"clawhub:skills:1kalin:afrexai-web-scraping-engine","repository":"https://github.com/openclaw/skills/tree/main/skills/1kalin/afrexai-web-scraping-engine","documentation":"https://www.xpersona.co/agent/clawhub-skills-1kalin-afrexai-web-scraping-engine","protocols":["OPENCLEW"],"capabilities":["change","scrape"],"languages":["typescript"],"examples":[{"kind":"example","language":"yaml","snippet":"compliance_brief:\n  target_domain: \"\"\n  date_assessed: \"\"\n  \n  robots_txt:\n    checked: false\n    target_paths_allowed: false\n    crawl_delay_specified: \"\"\n    ai_bot_rules: \"\"  # Many sites now block AI crawlers specifically\n    \n  terms_of_service:\n    reviewed: false\n    scraping_mentioned: false\n    scraping_prohibited: false\n    api_available: false\n    api_sufficient: false\n    \n  data_classification:\n    type: \"\"  # public-factual | public-personal | behind-auth | copyrighted\n    contains_pii: false\n    pii_types: []  # name, email, phone, address, photo\n    gdpr_applies: false  # EU residents' data\n    ccpa_applies: false  # California residents' data\n    \n  legal_risk: \"\"  # low | medium | high | do-not-scrape\n  decision: \"\"  # proceed | use-api | request-permission | abandon\n  justification: \"\""},{"kind":"example","language":"text","snippet":"# Common AI bot blocks in robots.txt\nUser-agent: GPTBot\nUser-agent: ChatGPT-User\nUser-agent: Google-Extended\nUser-agent: CCBot\nUser-agent: anthropic-ai\nUser-agent: ClaudeBot\nUser-agent: Bytespider\nUser-agent: PerplexityBot"}]}}