agentCLAWHUBUnverified

抖音搜索爬虫

爬取抖音爆款视频和文案数据,使用 Playwright 自动化浏览器操作,支持搜索关键词、获取热榜、提取视频信息和文案等功能。 Skill: 抖音搜索爬虫 Owner: terrycarter1985 Summary: 爬取抖音爆款视频和文案数据,使用 Playwright 自动化浏览器操作,支持搜索关键词、获取热榜、提取视频信息和文案等功能。 Tags: latest:1.2.0 Version history: v1.2.0 | 2026-05-31T04:56:35.540Z | user 真实搜索:移动端UA解析真实搜索结果,自然语言调用指引 v1.1.0 | 2026-05-20T00:04:11.497Z | user 支持自然语言搜索触发;移动端UA绕过验证码;真实数据提取替代mock数据 Archive index: Archive v1.2.0: 11 files, 15862 bytes Files: examples/search_requests.txt (310b), install_playwright_docker.py (

OpenClaw

Rank

62

Safety

84

Downloads

1.1k

Updated

Oct 11, 2026

Version

1.2.0

Source

CLAWHUB

About

What it does, and when to use it.

Capability contract not published. No trust telemetry is available yet. 1.1K downloads reported by the source. Last updated 10/11/2026.

Avoid when

  • Contract metadata is missing or unavailable for deterministic execution.

Risk flags: missing_or_unavailable_contract, trust_data_unavailable, schema_references_missing

Public facts

Every fact links back to the source it came from.

Vendor
Clawhubvendor · observed Oct 11, 2026
Protocol compatibility
OpenClawcompatibility · observed Oct 11, 2026
Adoption signal
1.1K downloadsadoption · observed Oct 11, 2026
Latest release
1.2.0release · observed May 31, 2026
Handshake status
UNKNOWNsecurity

Install and run

Setup complexity: low.

clawhub skill install s17brwfrqyjhbjgadkvar20h8x8492g8:douyin-search-scraper
  1. Setup complexity is LOW. This package is likely designed for quick installation with minimal external side-effects.
  2. Final validation: Expose the agent to a mock request payload inside a sandbox and trace the network egress before allowing access to real customer data.

Contract: missing

curl -s "https://www.xpersona.co/api/v1/agents/clawhub-terrycarter1985-douyin-search-scraper/snapshot"

Documentation

CLAWHUB

16,782 characters of source documentation, loaded on request.

Extracted files

5 files captured from the source.

SKILL.md

---
name: douyin-scraper
description: 爬取抖音爆款视频和文案数据,使用 Playwright 自动化浏览器操作,支持搜索关键词、获取热榜、提取视频信息和文案等功能。
---

# 抖音爆款爬虫 Skill

使用 Playwright 自动化浏览器操作,爬取抖音爆款视频和文案数据。

## Agent 调用指引

当用户用自然语言请求抖音相关操作时,**直接执行对应命令**,不需要再确认。

| 用户意图 | 命令 |
|---------|------|
| 搜索海鲜视频 | `python scripts/scraper.py search --keyword "海鲜" --limit 10` |
| 搜一下小龙虾 | `python scripts/scraper.py search --keyword "小龙虾" --limit 10` |
| 看看热榜 | `python scripts/scraper.py hot --limit 20` |
| 美食热榜 | `python scripts/scraper.py hot --category "美食" --limit 20` |
| 搜索并保存 | `python scripts/scraper.py search --keyword "海鲜" --limit 15 --output seafood.json` |

### 自然语言匹配规则

1. **搜索类** — 用户说"搜索/搜一下/找/看看 + 关键词"→ `search --keyword "<关键词>"`
2. **热榜类** — 用户说"热榜/热搜/热门/排行榜"→ `hot`
3. **分类热榜** — 用户说"XX热榜"→ `hot --category "<分类>"`
4. **保存结果** — 用户提到"保存/导出/下载结果"→ 加 `--output <文件名>.json`

> **工作目录**: 命令在 skill 根目录下执行,即 `cd /root/.openclaw/workspace/douyin-scraper && ...`

## 功能特性

- 🔍 **关键词搜索** — 按关键词搜索抖音视频,解析真实搜索结果
- 📊 **热榜获取** — 获取抖音热榜数据
- 📝 **文案提取** — 提取视频标题、描述、标签等
- 🎬 **视频信息** — 获取播放量、点赞数、评论数等
- 🔗 **链接收集** — 收集视频链接用于后续下载
- 💾 **数据导出** — 支持 JSON / CSV 格式导出

## 依赖

需要 Playwright + Chromium:

```bash
pip install playwright
playwright install chromium
```

## 命令参考

### 搜索

```bash
python scripts/scraper.py search --keyword "海鲜" --limit 10
python scripts/scraper.py search -k "海鲜售卖" -n 15 -o seafood.json
python scripts/scraper.py search -k "小龙虾" -n 10 -f csv -o crayfish.csv
```

### 热榜

```bash
python scripts/scraper.py hot --limit 20
python scripts/scraper.py hot --category "美食" -n 20 -o food_hot.json
```

### 选项

| 选项 | 说明 |
|------|------|
| `--keyword, -k` | 搜索关键词 |
| `--limit, -n` | 结果数量 (默认 10/20) |
| `--output, -o` | 输出文件路径 |
| `--format, -f` | 输出格式: json (默认), csv |
| `--no-headless` | 显示浏览器窗口 (调试用) |

## 输出格式

### JSON

```json
[
  {
    "title": "视频标题",
    "description": "视频描述",
    "author": "作者昵称",
    "play_count": 1000000,
    "like_count": 50000,
    "comment_count": 2000,
    "share_count": 1000,
    "url": "https://www.douyin.com/video/xxx",
    "tags": ["标签1", "标签2"],
    "publish_time": "2026-05-31"
  }
]
```

### CSV

```csv
title,author,play_count,like_count,comment_count,url,tags
视频标题,作者昵称,1000000,50000,2000,https://...,标签1|标签2
```

## 注意事项

⚠️ **重要提示:**

1. **遵守平台规则** — 合理使用,避免频繁请求
2. **请求间隔** — 默认 2 秒延时,可通过 `--delay` 调整
3. **数据用途** — 仅供学习和研究
4. **账号安全** — 不要登录账号,避免风控
5. **IP 限制** — 注意 IP 被封禁风险

## 故障排除

| 问题 | 解决方案 |
|------|---------|
| 浏览器启动失败 | `playwright install chromium` |
| 页面加载超时 | 检查网络,尝试代理 |
| 找不到元素 | 抖音页面可能更新,需更新选择器 |
| 返回空结果 | 可能被风控,尝试降低频率或换 IP |

README.md

# 抖音爆款爬虫 Skill

使用 Playwright 自动化浏览器操作,爬取抖音爆款视频和文案数据。

## 📦 安装

### 方式一:一键安装(推荐)

```bash
# 进入 skill 目录
cd /root/.openclaw/workspace/skills/douyin-scraper

# 运行安装脚本
./install.sh
```

### 方式二:手动安装 - Python 版本

```bash
# 进入 skill 目录
cd /root/.openclaw/workspace/skills/douyin-scraper

# 创建虚拟环境
python3 -m venv venv

# 激活虚拟环境
source venv/bin/activate

# 安装依赖
pip install playwright

# 安装浏览器
playwright install chromium
```

### 方式三:Node.js 版本

```bash
# 进入 skill 目录
cd /root/.openclaw/workspace/skills/douyin-scraper

# 安装依赖
npm install

# 安装浏览器
npx playwright install chromium
```

## 🚀 快速开始

### 方式一:使用启动脚本(推荐)

```bash
# 搜索关键词
./run.sh search --keyword "海鲜" --limit 10

# 获取热榜
./run.sh hot --limit 20

# 搜索并保存结果
./run.sh search --keyword "海鲜售卖" --limit 20 --output seafood_videos.json
```

### 方式二:手动激活虚拟环境

```bash
# 激活虚拟环境
source venv/bin/activate

# 搜索关键词
python scripts/scraper.py search --keyword "海鲜" --limit 10

# 获取热榜
python scripts/scraper.py hot --limit 20

# 搜索并保存结果
python scripts/scraper.py search --keyword "海鲜售卖" --limit 20 --output seafood_videos.json
```

### Node.js 版本

```bash
# 搜索关键词
node scripts/douyin_scraper.js search "海鲜" 10

# 获取热榜
node scripts/douyin_scraper.js hot 20

# 搜索并保存结果
node scripts/douyin_scraper.js search "海鲜售卖" 20 seafood_sales.json json
```

## 📝 使用示例

### 示例 1:搜索海鲜售卖视频

```bash
# Python 版本
python scripts/scraper.py search --keyword "海鲜售卖" --limit 15 --output seafood_sales.json

# Node.js 版本
node scripts/douyin_scraper.js search "海鲜售卖" 15 seafood_sales.json json
```

### 示例 2:获取美食热榜

```bash
# Python 版本
python scripts/scraper.py hot --category "美食" --limit 20 --output food_hot.json

# Node.js 版本
node scripts/douyin_scraper.js hot "美食" 20 food_hot.json json
```

### 示例 3:导出 CSV 格式

```bash
# Python 版本
python scripts/scraper.py search --keyword "小龙虾" --limit 10 --format csv --output crayfish.csv

# Node.js 版本
node scripts/douyin_scraper.js search "小龙虾" 10 crayfish.csv csv
```

## 📊 输出数据格式

### JSON 格式

```json
[
  {
    "title": "视频标题",
    "description": "视频描述",
    "author": "作者昵称",
    "play_count": 1000000,
    "like_count": 50000,
    "comment_count": 2000,
    "share_count": 1000,
    "url": "https://www.douyin.com/video/xxx",
    "tags": ["标签1", "标签2"],
    "publish_time": "2026-03-21"
  }
]
```

### CSV 格式

```csv
title,author,play_count,like_count,comment_count,url,tags
视频标题,作者昵称,1000000,50000,2000,https://...,标签1|标签2
```

## ⚙️ 配置选项

### Python 版本

```bash
# 无头模式(不显示浏览器)
--headless

# 请求间隔(秒)
--delay 3.0

# 输出格式
--format json|csv
```

### Node.js 版本

在代码中修改配置:

```javascript
const scraper = new DouyinScraper({
    headless: true,  // 无头模式
    delay: 2000      // 请求间隔(毫秒)
});
```

## ⚠️ 注意事项

1. **遵守抖音平台规则** - 合理使用,避免频繁请求
2. **请求间隔** - 建议在请求之间添加适当延时(默认 2 秒)
3. **数据用途** - 仅供学习和研究使用
4. **账号安全** - 不要登录账号,避免风控
5. **IP 限制** - 注意 IP 被封禁的风险

## 🔧 故障排除

### 问题:浏览器启动失败

**解决方案:**
```bash
# Python 版本
playwright install chromium

# Node.js 版本
npx playwright install chromium
```

### 问题:页面加载超时

**解决方案:**
- 增加超时时间
- 检查网络连接
-

_meta.json

{
  "ownerId": "kn72jmd20ws94jr0p8b3p24wyn82abgj",
  "slug": "douyin-search-scraper",
  "version": "1.2.0",
  "publishedAt": 1780203395540
}

skill-card.md

## Description:

爬取抖音爆款视频和文案数据,使用 Playwright 自动化浏览器操作,支持搜索关键词、获取热榜、提取视频信息和文案等功能。

This skill is ready for commercial/non-commercial use.

## Publisher:

[terrycarter1985](https://clawhub.ai/user/terrycarter1985)

### License/Terms of Use:

MIT-0

## Use Case:

Developers and operators use this skill to search Douyin keywords, retrieve trending-video data, and export parsed video metadata for downstream review or analysis.

### Deployment Geography for Use:

Global

## Known Risks and Mitigations:

Risk: Browser scraping and file-writing commands may run against live Douyin pages with limited user confirmation.

Mitigation: Require confirmation before scraping or writing output files, and run the skill only for approved keywords and destinations.

Risk: Installation and runtime behavior download browser automation components and launch Chromium.

Mitigation: Use an isolated, unprivileged environment with no sensitive files mounted and pin reviewed dependency versions.

Risk: The release uses unsafe browser and installation defaults according to the security summary.

Mitigation: Avoid running as root and review the installation and browser launch settings before deployment.

## Reference(s):

- [ClawHub skill page](https://clawhub.ai/terrycarter1985/skills/douyin-search-scraper)
- [Playwright documentation](https://playwright.dev/)

## Skill Output:

**Output Type(s):** [text, shell commands, configuration, files]

**Output Format:** [Terminal text with optional JSON or CSV output files]

**Output Parameters:** [1D]

**Other Properties Related to Output:** [Outputs depend on live Douyin pages, browser automation behavior, rate limits, and requested keyword, limit, category, and output format.]

## Skill Version(s):

1.2.0 (source: server release metadata)

## Ethical Considerations:

Users should evaluate whether this skill is appropriate for their environment, review any generated or modified files before relying on them, and apply their organization's safety, security, and compliance requirements before deployment.

examples/search_requests.txt

# 搜索请求示例

# 以下是可以直接对 Agent 说的自然语言请求,
# Agent 会自动转换为对应的 scraper 命令执行。

搜索一下海鲜视频
搜一下小龙虾的做法
找一些海鲜售卖相关的视频
看看美食热榜
抖音热榜有什么
搜一下旅行vlog并保存结果
Github ReposUpdated 2d agoRank 70

AionUi

Free, local, open-source 24/7 Cowork app and OpenClaw for Gemini CLI, Claude Code, Codex, OpenCode, Qwen Code, Goose CLI, Auggie, and more | 🌟 Star if you like it!

MCPOPENCLAW
Github ReposUpdated 6mo agoRank 70

activepieces

AI Agents & MCPs & AI Workflow Automation • (~400 MCP servers for AI agents) • AI Automation / AI Agent with MCPs • AI Workflows & AI Agents • MCPs for AI Agents

OPENCLAW
Github ReposUpdated 6mo agoRank 70

cherry-studio

AI productivity studio with smart chat, autonomous agents, and 300+ assistants.

MCPOPENCLAW
Github ReposUpdated 7mo agoRank 70

CopilotKit

The Frontend for Agents & Generative UI. React + Angular

OPENCLAW

Machine-readable data

The same record, as JSON, for agents and crawlers.

{
  "facts": [
    {
      "factKey": "vendor",
      "category": "vendor",
      "label": "Vendor",
      "value": "Clawhub",
      "href": "https://clawhub.ai/terrycarter1985/skills/douyin-search-scraper",
      "sourceUrl": "https://clawhub.ai/terrycarter1985/skills/douyin-search-scraper",
      "sourceType": "profile",
      "confidence": "medium",
      "observedAt": "2026-10-11T10:29:52.078Z",
      "isPublic": true
    },
    {
      "factKey": "protocols",
      "category": "compatibility",
      "label": "Protocol compatibility",
      "value": "OpenClaw",
      "href": "https://www.xpersona.co/api/v1/agents/clawhub-terrycarter1985-douyin-search-scraper/contract",
      "sourceUrl": "https://www.xpersona.co/api/v1/agents/clawhub-terrycarter1985-douyin-search-scraper/contract",
      "sourceType": "contract",
      "confidence": "medium",
      "observedAt": "2026-10-11T10:29:52.078Z",
      "isPublic": true
    },
    {
      "factKey": "traction",
      "category": "adoption",
      "label": "Adoption signal",
      "value": "1.1K downloads",
      "href": "https://clawhub.ai/terrycarter1985/douyin-search-scraper",
      "sourceUrl": "https://clawhub.ai/terrycarter1985/douyin-search-scraper",
      "sourceType": "profile",
      "confidence": "medium",
      "observedAt": "2026-10-11T10:29:52.078Z",
      "isPublic": true
    },
    {
      "factKey": "latest_release",
      "category": "release",
      "label": "Latest release",
      "value": "1.2.0",
      "href": "https://clawhub.ai/terrycarter1985/douyin-search-scraper",
      "sourceUrl": "https://clawhub.ai/terrycarter1985/douyin-search-scraper",
      "sourceType": "release",
      "confidence": "medium",
      "observedAt": "2026-05-31T04:56:35.540Z",
      "isPublic": true
    },
    {
      "factKey": "handshake_status",
      "category": "security",
      "label": "Handshake status",
      "value": "UNKNOWN",
      "href": "https://www.xpersona.co/api/v1/agents/clawhub-terrycarter1985-douyin-search-scraper/trust",
      "sourceUrl": "https://www.xpersona.co/api/v1/agents/clawhub-terrycarter1985-douyin-search-scraper/trust",
      "sourceType": "trust",
      "confidence": "medium",
      "observedAt": null,
      "isPublic": true
    }
  ],
  "events": [
    {
      "eventType": "release",
      "title": "Release 1.2.0",
      "description": "真实搜索:移动端UA解析真实搜索结果,自然语言调用指引",
      "href": "https://clawhub.ai/terrycarter1985/douyin-search-scraper",
      "sourceUrl": "https://clawhub.ai/terrycarter1985/douyin-search-scraper",
      "sourceType": "release",
      "confidence": "medium",
      "observedAt": "2026-05-31T04:56:35.540Z",
      "isPublic": true
    }
  ]
}

Record generated Oct 11, 2026.

Sponsored

Ads related to 抖音搜索爬虫 and adjacent AI workflows.