工作靠手做,很快消失
把竞争对手价格复制到表格要花几个小时,两天后就过时了。做过的人知道,没做过的人得从头开始。
concorrente.com.br/precos
每日监控示例。页面没有变化,就不会生成提醒、webhook 或电子邮件:总是触发的提醒,没人会看。
提取一次只能解决单次问题。知道竞争对手昨天降价、供应商改了期限,或招标已经开始,才能改变公司当天的行动。
把竞争对手价格复制到表格要花几个小时,两天后就过时了。做过的人知道,没做过的人得从头开始。
客户在谈判时提起,您才知道竞争对手降价了。事情发生两周以后。
云端 scraper 会把地址,有时连内容一起,发到他们的服务器。对收集合同、招标或保密价格的人来说,这已经足够被否决。
每次检查都会保存页面快照。有内容变化时,系统会在准确字段中展示原来是什么、变成了什么。不是一句“这个 URL 有变化”。

已处理的页面数量,提供干净的 Markdown 或您要求格式的 JSON,可供其他模块直接使用。
每个品牌最多监控五十个页面,每个页面都有自己的检查间隔和每月支出上限。
每小时、每六小时、每天两次、每天或每周。按页面选择,不必全部统一。
只有变化才会成为提醒。连续三次检查相同,就保持安静,这才让人会打开第四次。
任何人一个下午都能写出 scraper。成本高的是后面的事:页面改版、地址失效、提醒变成噪音,以及费用在无人察觉时不断流失。
这不是套壳的云服务。您监控的地址和返回的内容,不会经过第三方服务器。这是收集合同和招标信息而无需向法务申请许可的唯一方式。
每次读取都会在相关字段中与上一次比较。页面相同,不生成提醒、webhook 或电子邮件。
每小时运行一次的监控器每天消耗 24 个额度。忘记关闭会在无声中耗尽余额,因此每个监控器都有独立的月度上限。
连续五次失败,监控器会停止并说明原因。带提醒地停止,胜过对一个已不存在的地址持续消耗额度。
自建脚本能用,云端 scraper 能用,实习生配表格也能用。关键在于,当规模和保密要求提升时,各自会收取什么代价。
一个页面、一组页面或整个网站,用于发现和追踪。
用于阅读的干净 Markdown,或你需要的准确字段,名称、价格、期限,以 JSON 提供。
选择间隔和支出上限。之后,只有内容发生变化时才会打扰你。
带着竞争对手昨天公布的价格进入谈判,而不是上个季度的价格。
跟踪供应商目录和交期,无需依赖某人每周打开网站。
将市场动态视为时间序列,而不是 WhatsApp 群里的截图。
没有菜单,没有横幅,便于 AI 阅读。
符合你 schema 的 JSON,直接送到表格或数据库。
原来是什么,变成了什么,何时变化,以及发送到哪里。
这里没有 scraper 订阅,使用的是运行其他模块的同一余额,按实际读取的页面消耗。
免费套餐每月提供 2,000 个页面和两个监控器。一个每日监控器每月消耗 90 个积分,因此无需信用卡也能监控最重要的两个页面。
查看所有套餐默认遵守,并会说明页面因它而被拒绝,而不是假装页面为空。对于你自己控制的页面,可以有意识地关闭这一限制,决定会被记录下来。
提取依据的是含义,而不是 HTML 中的固定位置,因此布局变化通常不会造成影响。若确实受到影响,监控器会失败并重试,如果连续失败五次,就会暂停并说明原因,而不是继续为无效内容消耗积分。
可以,凭据会保存在你账户的保险库中。由于引擎在你的基础设施内运行,该凭据不会发送到任何地方,这类事不该交给云端 scraper。
每个品牌最多五十个,每个都有自己的间隔和每月积分上限。上限可防止一个被遗忘的每小时监控器悄悄耗尽账户余额。
它保留在你的数据库中,使用你的密钥加密,可供其他模块使用,并且你随时可以完整导出。不会成为任何人的模型训练数据。
没有去处的采集只是闲置文件。这里,进入的数据会立刻成为其他模块的上下文。
