{"slug":"clawhub-zigu-creator-news-digest-v1","facts":[{"factKey":"vendor","category":"vendor","label":"Vendor","value":"Clawhub","href":"https://clawhub.ai/zigu-creator/skills/news-digest-v1","sourceUrl":"https://clawhub.ai/zigu-creator/skills/news-digest-v1","sourceType":"profile","confidence":"medium","observedAt":"2026-10-11T06:42:50.372Z","isPublic":true},{"factKey":"protocols","category":"compatibility","label":"Protocol compatibility","value":"OpenClaw","href":"https://www.xpersona.co/api/v1/agents/clawhub-zigu-creator-news-digest-v1/contract","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-zigu-creator-news-digest-v1/contract","sourceType":"contract","confidence":"medium","observedAt":"2026-10-11T06:42:50.372Z","isPublic":true},{"factKey":"traction","category":"adoption","label":"Adoption signal","value":"1.1K downloads","href":"https://clawhub.ai/zigu-creator/news-digest-v1","sourceUrl":"https://clawhub.ai/zigu-creator/news-digest-v1","sourceType":"profile","confidence":"medium","observedAt":"2026-10-11T06:42:50.372Z","isPublic":true},{"factKey":"latest_release","category":"release","label":"Latest release","value":"1.0.12","href":"https://clawhub.ai/zigu-creator/news-digest-v1","sourceUrl":"https://clawhub.ai/zigu-creator/news-digest-v1","sourceType":"release","confidence":"medium","observedAt":"2026-06-09T02:40:26.589Z","isPublic":true},{"factKey":"handshake_status","category":"security","label":"Handshake status","value":"UNKNOWN","href":"https://www.xpersona.co/api/v1/agents/clawhub-zigu-creator-news-digest-v1/trust","sourceUrl":"https://www.xpersona.co/api/v1/agents/clawhub-zigu-creator-news-digest-v1/trust","sourceType":"trust","confidence":"medium","observedAt":null,"isPublic":true}],"changeEvents":[{"eventType":"release","title":"Release 1.0.12","description":"v1.0.12 (2026-06-09) — Filtering Rules Expansion & Sync Fix Added 3 new exclusion categories to rules_config.py: cultural events/propaganda sessions (诵读会, 宣讲会, scientist spirit readings), credit-knowledge Q&A/encyclopedia content, and news briefings/morning digest formats (e.g. \"8点1氪\") — 8 new keywords total Fixed sync_to_skill.py: restored cross_day_dedup.py to the sync file list (was accidentally removed by cleanup logic) Manually cleaned residual duplicate entries in digest_output table v1.0.11 (2026-06-08) — People's Daily Primary Site & Cross-Day Dedup Improvement Added People's Daily primary site (paper.people.com.cn/rmrb/) as a new monitored source (id=47, priority=1) Enhanced cross_day_dedup.py with Hard Rule 4: mutual-title-inclusion detection (catches same-event reports from different outlets with completely different titles) Tuned Jaccard weight from 0.5 → 0.6 for better title-similarity scoring Restored header format: \"Sources: X | Articles: Y items\" in formatter.py Simplified SQL queries and optimized logging in stage2_5_llm_summary.py v1.0.10 (2026-06-05) — Header Count Fix & 5 New Filter Categories Fixed formatter.py article count in header: changed from pre-filter count (filtered_news length) to actual output count via placeholder + post-replacement Added title truncation protection: titles ending with commas/enumeration commas now get ellipsis appended to avoid misleading DB-truncated titles Added 5 new exclusion categories: Party-building/historical commemoration articles (17 keywords), solar-term/astronomical science popularization, official dismissal/prosecution notices (12 keywords, also added to corporate_scandal) v1.0.8 (2026-06-05) — Cross-Day Dedup & GBK Decoding New cross_day_dedup.py: compares today's candidates against the last 3 days of historical digests using a weighted scoring model — Title Jaccard(0.5) + Number match(0.25) + Content-word overlap(0.25) Hard rule: articles sharing no significant numbers → similarity forced to 0 (auto-passes recurring reports like PMI/CPI without whitelist) Three-tier verdict: ≥0.75 block / 0.60–0.75 warn-keep / <0.60 pass Title rewrite rule 9: exhibition/attendance titles → event subject focus; IPO/financing/earnings → retain company name Anti-hallucination rule 10: summaries must derive exclusively from source text, no external knowledge injection stage1_fetch.py: source count changed from hardcoded 42 to dynamic len(WEBSITES) GBK decoding: decode_response() merged into main fetch flow, supports all known GBK-encoded sources v1.0.7 (2026-06-01) — GBK Encoding Fix & Content-Type Blacklist fetcher.py: new decode_response() function forces GBK decoding for known GBK sources (People's Daily Overseas Edition), fixing Cyrillic mojibake at the root stage2_5_llm_summary.py: mojibake title detection — prompts LLM to generate accurate title from article body when garbled text is detected formatter.py: fallback filter to discard garbled titles New TITLE_EXCLUDE_KEYWORDS: excludes opinion pieces (评论丨, 时评, 社评), investigative reports (深度观察, 记者观察), HR/recruitment (招聘, 面试, 人事任免), obituaries (讣告), exclusive interviews (专访) New URL_EXCLUDE_PATTERNS: blocks People's Daily opinion channel and newspaper commentary pages Timeout recommendation: 900s → 1200s (实测 total runtime ~1150s for 50-article LLM batch + fetch)","href":"https://clawhub.ai/zigu-creator/news-digest-v1","sourceUrl":"https://clawhub.ai/zigu-creator/news-digest-v1","sourceType":"release","confidence":"medium","observedAt":"2026-06-09T02:40:26.589Z","isPublic":true}]}