01
托管的网页数据采集与监控平台。你在浏览器里编排工作流(URL 生成 → 抓取 → 存储 → 通知),我们在云端按调度执行——无需自建爬虫或浏览器插件。
注册免费账号,新建工作流,添加抓取节点,粘贴公开样例 URL,点「抓取字段」并勾选列,再手动运行一次。也可在首页粘贴 URL 做快速分析,或看《入门》指南。
不是。编排在浏览器完成,执行在云端。笔记本关机后,已启用且设了间隔的工作流仍会按调度运行。
不需要。用自然语言描述字段(如「标题、价格、商品链接」)即可。抓取节点会发现候选列,由你勾选保留;规则会在后续运行中复用。
「采集」通常指每次运行都写入数据集。「监控」是同一套图,加上调度,并用通知节点在新行或字段变化时发邮件。画布节点相同,差在间隔与通知条件。
在工作流编辑器右侧打开 AI 聊天,可用自然语言分析页面或调整当前图。建议会显示在画布上,点「保存」后才写入账号。需配置 AI_API_KEY。
02
可以。先抓列表(保留链接列),再接详情抓取,input_field 指向该列。详情行在匹配成功时会合并列表字段。详情按请求的 URL 次数扣额度(1 次请求 = 1 额度)。
引擎适合可公开访问的页面。需登录、强拦爬虫或验证码的站点常会失败。换更简单的公开列表页,或改写需求文案后再试。打开该次运行的节点 error 可读具体原因。
URL 生成单节点最多 500 条。每个抓取节点每次运行默认最多处理 20 个 URL,可用 limit 调高。生成很多页时记得同步提高下游 scrape.limit。
工作流的 interval_minutes:1440≈每天,60≈每小时(视套餐)。空表示仅手动。先手动跑通并确认字段,再改为启用并设间隔,避免试验阶段狂发邮件。
通知节点 when=new:有新键行时发;when=field_change:监视字段(如 price)变化时发。可先用测试/dry-run 看触发条件。默认发到账号邮箱。
存储节点按 key_fields upsert(默认常含 url/link)。请设稳定的商品 URL 等业务键,这样重跑会更新价格而不是复制行。
不会因为「暂停」而扣额度。额度只在实际运行出结果时消耗。暂停只是跳过调度;你仍可手动运行。
03
1 额度 = 抓取节点实际请求网页 1 次。免费每月 20;Starter 2,000、Pro 5,000、Business 15,000。年付一次性发放 12× 月额度。
有。免费版每月 20 额度,无需绑卡。付费最高每月 15,000 额度;年付约省 20%,并一次性发放 12 倍月额度。详见定价页。
只有运行时抓取节点实际请求网页才扣。保存画布、URL 生成、存储、通知不扣。额度用尽 → HTTP 402;升级或等下个周期。
1 额度对应抓取节点实际请求网页的 1 次。列表翻 3 页扣 3;详情请求 10 个 URL 扣 10。与输出行数无关。
新运行会返回 HTTP 402,直到下个周期或升级。已有数据集仍可查看。
可以。年付开通时一次性发放 12 倍月额度。
数据会保留。当前周期结束后按新套餐发放额度。
人工开通的套餐可在周期结束前由管理员撤销。接入 Stripe 后将遵循其退款政策。
04
可以。控制台创建以 hulu_ 开头的 API Key,用 Authorization: Bearer 调用 /api/v1 工作流、运行、数据集与节点预设。网站登录用的 cookie 不能用于 API。
控制台 → 数据集:浏览行,导出 CSV 或 JSON(有行数上限)。也可用 API:GET /api/v1/datasets/{id}/rows 或 …/export。
05
目标网址由你指定。请只采集你有权抓取的公开页面,并自行遵守目标站条款与适用法律。我们不会替你绕过登录或验证码。DPA / 企业需求请走联系表单。
当前面向公开页面。需要登录、会话或验证码的站点不在支持范围内。请换你有权访问且无需登录的公开 URL。