使用案例 • 25 分钟阅读
网页抓取与数据收集
自动化数据收集、价格监控与复杂的网页抓取工作流。
利用 OpenClaw 的浏览器自动化从任意网站收集数据:处理分页、抽取动态内容,并长期监控变化。
Tutorial.step
你将搭建什么
- 自动化多页抓取流水线
- 带通知的定时价格监控系统
- 结构化数据抽取(JSON/CSV)
- 新闻与研究资料的归档工作流
Tutorial.step
基础数据抽取
从一个页面的自然语言请求开始:
Chat Prompt
"Go to https://example.com/product and extract: - Product name - Current price - Stock status Save this data to products.json"
Tutorial.step
价格监控
自动检查价格,并在降价时通知:
openclaw.json
{
"cron": {
"enabled": true,
"jobs": [
{
"name": "Price Monitor",
"cron": "0 9 * * *",
"message": "Visit [Product URL], extract price, and notify me if it drops below $500. Log history to prices.csv"
}
]
}
}Tutorial.step
处理分页
教 OpenClaw 导航,从而抓取整个目录:
"访问 [店铺 URL] 的第一页,提取所有商品链接,然后点击“下一页”重复直到最后;最后逐个访问链接并抽取规格信息。"
Tutorial.step
数据存储与处理
明确告诉 OpenClaw 你希望如何保存数据:
- JSON: 适合 Web 应用与进一步自动化处理。
- CSV: 可直接导入 Excel 或 Google Sheets。
- Markdown: 适合研究笔记或 Obsidian。
Tutorial.step
最佳实践
抓取伦理
始终遵守
robots.txt,合理设置延迟避免压垮服务器,并遵循目标网站的服务条款。