返回技能库
数据采集 / 自动化精选

Apify 全能网页采集

用 Apify Actor 选择、运行和管理网页采集任务,覆盖搜索、社交、地图、电商和评论等常见来源,并输出结构化结果。

查看安装方式

技能说明

适合网页数据采集、市场研究和竞品分析;技能会根据目标选择 Actor、整理输入、运行任务并格式化结果。需要 Apify 账号和 Node.js 20.6+;Actor 按结果或事件计费,使用前确认费用、来源规则和隐私边界。

关于此技能

通过 Apify CLI 调用网页采集 Actor,把公开网页内容整理成结构化数据,适合研究、监测和数据提取任务。

核心能力

Actor 选择与输入配置

根据平台和目标从索引中选择合适的 Actor,读取输入模式并配置采集范围、结果数量和输出格式。

运行任务并取得结果

以 JSON 方式启动或运行 Actor,读取运行状态、数据集 ID,并导出 JSON 或 CSV 结果。

覆盖常见公开来源

可用于搜索、社交、地图、电商、评论、趋势等多类公开数据;具体效果取决于目标站点和 Actor。

适用场景

市场与竞品研究

采集公开的产品、价格、评价和内容信息,辅助市场判断与竞品对比。

线索与公司研究

从授权范围内的公开页面提取企业、职位或联系信息,整理成可复用的数据集。

舆情与趋势监测

按明确范围采集公开讨论、趋势或评论数据,形成后续分析所需的结构化输入。

使用步骤

  1. 01

    第一步:明确范围

    先说明目标平台、字段、数量、时间范围和输出格式,只采集获得授权且可以合法使用的公开数据。

  2. 02

    第二步:准备环境

    安装 Apify CLI 1.5.0 以上版本,登录 Apify 账号或配置 APIFY_TOKEN,并选择合适的 Actor。

  3. 03

    第三步:运行并核对

    先读取 Actor 输入模式和常见限制,再运行任务;检查状态、数据集、字段质量和可能产生的费用。

  4. 04

    第四步:导出交付

    将数据集导出为 JSON 或 CSV,说明采集数量、字段、运行链接和使用限制。

常见问题

需要什么账号和环境?+

需要 Apify 账号、Apify CLI 1.5.0 以上版本和 Node.js 20.6 以上;命令行登录或使用 APIFY_TOKEN。

会不会产生费用?+

可能会。Actor 通常按结果或事件计费,免费额度和具体价格以 Apify 控制台及所选 Actor 页面为准。

所有网站都能采集吗?+

不能保证。目标站点可能有登录、反爬、地区限制或结构变化;必须遵守网站条款、隐私要求、robots 规则和适用法律。

可以采集敏感个人信息吗?+

未经明确授权不应采集或处理敏感个人信息,也不要绕过访问控制。

安装前检查

把兼容性、来源和安装入口先看清楚,再放进自己的工作流。

信息卡
兼容平台

Claude Code · Codex · Cursor

来源状态

已提供来源链接

安装方式

命令可直接复制

最近整理

2026/08/28

安装提醒:即使有清晰的来源和安装方式,也建议先阅读 SKILL.md,确认它会访问哪些文件和服务。

安装命令
npx skills add https://github.com/apify/agent-skills --skill apify-ultimate-scraper

适用平台与标签

Claude CodeCodexCursorWindsurfGemini CLI兼容 Agent Skills#网页采集#Apify#市场研究#数据提取