OpenClaw 定时追踪信息更新:如何避免消耗搜索 API 配额

这篇讲的不是某一个新闻任务的特例,而是一种更通用的思路:凡是高频、固定主题、持续追踪的任务,都应该先考虑检索成本,再决定用什么搜索入口。

如果你在用 OpenClaw 做定时更新,这个经验很值得提前用上。

它不只适用于国际新闻,也适用于:

  • 某个大公司的动态追踪

  • 某个行业的持续观察

  • 某个名人或关键人物的公开动向

  • 某个重大事件的阶段性进展

  • 某个垂直主题的长期监控

这类任务有一个共同点:执行频率高、主题稳定、目标是持续追踪新增。

问题往往不是“能不能搜到”,而是“能不能长期跑得起”。如果一上来就用有月度配额的搜索 API,任务越多,越容易把额度跑空。

这篇主要讲一个很实用的思路:把“定时追踪任务”的第一层检索,从有配额的搜索 API,切到免费且更适合固定主题追踪的入口,比如 Google News 页面抓取。

对应原始帖子:

  • SunAI 帖子:https://www.sunai.net/t/topic/1186

一 核心结论

一句话版:

定时新闻更新任务,优先用 web_fetch 直接抓 Google News;把真正需要付费或有配额的搜索能力,留给少量高价值场景。

原因很直接:

  • 定时任务次数高

  • 关键词通常固定

  • 目标是“持续追踪”,不是“开放式探索”

  • 第一层检索其实不需要太强的 AI 搜索能力

换句话说,很多时候你并不是要“全网做深度语义搜索”,而只是想稳定拿到“这个主题最近又发生了什么”。这种场景下,Google News 反而更合适。


二 问题出在哪

很多人一开始做新闻类自动化,会默认上搜索 API,比如 web_search

这当然不是不能用,但问题在于:它适合高质量检索,不适合被高频定时任务无脑消耗。

拿 Brave Search 这类月度免费额度来说,如果每小时跑一次,一个月就是:

  • 24 次 / 天

  • 720 次 / 月

如果你有 3 个类似任务,一个月就是 2160 次。到这里,免费额度基本就没了。

所以问题不在“搜索效果好不好”,而在于:

你有没有把昂贵能力放在真正值得它出现的位置上。


三 更稳的做法

更稳的做法是把任务拆成两层。

第一层:低成本拉取候选新闻

这一层只负责把相关新闻列表抓回来。

这里直接用:

  • web_fetch

  • Google News 搜索结果页

例如英文搜索:

https://news.google.com/search?q=Iran%20Israel%20US%20conflict&hl=en-US&gl=US&ceid=US:en

中文搜索也可以:

https://news.google.com/search?q=美国伊朗冲突&hl=zh-CN&gl=CN&ceid=CN:zh-Hans

但从实际效果看,英文搜索通常更及时,来源也更全,更适合国际新闻追踪。

第二层:再做筛选和整理

候选新闻抓回来以后,再去判断:

  • 过去 1 小时有没有明显新增

  • 哪几条值得写进摘要

  • 有没有重复内容

  • 是否需要发帖 / 发消息

也就是说,真正的判断力放在后面,先别把配额浪费在第一步。


四 为什么 Google News 这类页面更适合定时任务

它适合的原因,不是什么“更高级”,而是它和这个任务的目标更匹配。

1. 免费

最现实的优势就是:不用消耗搜索 API 配额。

对定时任务来说,这一点非常关键。因为你跑得不是一次,而是长期、固定频率地跑。

2. 足够快

在新闻抓取这种场景里,web_fetch 抓 Google News 页面,响应通常已经够用。

你不是在等一个多轮推理结果,而是在拉一个新闻聚合页。这个速度对 hourly 任务完全够了。

3. 来源更集中

Google News 天然就是新闻聚合入口。对于国际新闻,它经常能比较快地把 BBC、Reuters、Guardian、NYT、WSJ、CNBC 这些来源汇总出来。

这对“专题追踪任务”特别有用,因为你不需要自己先决定去哪几个站点抓。

4. 更适合固定关键词场景

如果你的任务是长期盯一个主题,比如:

  • 伊朗局势

  • 某个公司动态

  • 某个行业重大事件

  • 某类政策更新

那关键词其实是稳定的。既然关键词稳定,用一个固定的 Google News 搜索页作为入口,通常就足够了。


五 什么时候还应该用搜索 API

也不是说搜索 API 就没价值。

更准确的说法是:别让它承担不该它承担的高频苦力活。

下面这些场景,还是值得用 web_search、Tavily、Exa 这类能力:

  • 你要做开放式研究,不是固定主题追踪

  • 你要搜的不是新闻,而是网页、博客、论坛、文档混合结果

  • 你需要更强的语义召回,而不是关键词匹配

  • 你需要更高质量的答案整合,而不只是新闻列表

可以这样理解:

  • Google News + web_fetch:适合“定时追踪”

  • 搜索 API:适合“深度研究”

把这两个场景分开,资源才用得值。


六 在 OpenClaw 里怎么落地

这类任务在 OpenClaw 里,推荐的链路是:

暂时无法在飞书文档外展示此内容

这里有几个点比较关键:

1. 用 cron 做定时触发

如果是 hourly 任务,OpenClaw cron 很适合。它负责定时叫醒,不负责具体新闻逻辑。

2. 用 subagent 跑任务

如果任务要抓网页、整理内容、判断是否值得发,就比较适合用 subagent 跑。主链路会更干净。

3. 维护状态文件

状态文件必须有,不然很容易重复发同一批新闻。

至少建议记录:

  • 上次检查时间

  • 上次发布时间

  • 已见过的链接

  • 最近一次结果是发帖还是跳过

4. 没有新增时要静默

这是体验上很重要的一点。

定时任务不是每次都必须产出内容。对于新闻追踪任务来说,“无显著新增,正常跳过”本身就是成功执行的一部分。


七 一个很实用的对比

方案 免费额度 适合场景 优点 缺点
web_search(Brave 等) 通常有限 深度搜索、开放式问题 结果质量高,适合探索 定时高频任务容易消耗配额
web_fetch + Google News 基本不受搜索配额影响 固定关键词新闻追踪 免费、稳定、来源集中 需要自己做后续筛选
Tavily / Exa 有免费额度或试用额度 深度研究、语义搜索 更智能,适合复杂问题 仍不适合长期高频无脑轮询

这张表其实就说明了一个判断原则:

不要把“最贵的能力”放在“最机械的步骤”里。


八 一个适合复用的任务思路

如果你之后想自己搭类似任务,可以直接参考这个思路:

  1. 先确定固定关键词

  2. 用 Google News 搜索页作为第一层入口

  3. web_fetch 拉回候选新闻

  4. 对候选结果做去重和筛选

  5. 判断是否达到“值得发布”的门槛

  6. 有新增就输出摘要,没有就跳过

  7. 维护状态文件,避免重复发旧内容

这套方法不只适合国际冲突新闻,也可以套到别的场景:

  • 某行业政策更新

  • 某公司相关新闻追踪

  • 某产品发布节奏跟踪

  • 某国家市场变化监控


九 经验总结

  1. 定时新闻任务首先要考虑的,不是“能不能搜到”,而是“能不能长期跑得起”。

  2. 对固定关键词的新闻追踪来说,web_fetch + Google News 往往比高频调用搜索 API 更划算。

  3. 搜索 API 适合深度研究,不适合拿来给高频定时任务当默认入口。

  4. 任务做得稳不稳,关键不只是抓新闻,还包括跳过策略、状态文件和发布节奏控制。


十 这个经验适用于哪些通用场景

这个经验并不只适用于国际冲突新闻。

只要你的任务满足下面这几个条件,它基本都适用:

  • 需要高频定时检查,比如每小时、每 2 小时、每天多次

  • 主题相对固定,不是开放式研究

  • 目标是持续追踪新增,而不是一次性做深度分析

  • 第一层更需要“稳定拿到候选信息”,而不是“最强语义搜索”

可以直接套用到这些场景。

1. 某个大公司的动态

比如持续跟踪:

  • Apple

  • Tesla

  • NVIDIA

  • OpenAI

  • Meta

  • 字节跳动

适合盯的内容包括:

  • 财报

  • 新产品发布

  • 高管变动

  • 监管事件

  • 大额投资、收购、裁员

这类任务对做公司研究、竞争情报、舆情追踪都很有用。

2. 某个行业的连续变化

比如:

  • AI 行业

  • 半导体行业

  • 新能源汽车

  • 跨境电商

  • 国际物流

  • 医药生物

这种场景特别适合做成“行业动态追踪器”。如果你后面还要做股票分析、行业判断或者写周报,前面这层自动收集会很省时间。

3. 某个名人或关键人物

比如持续跟踪:

  • 马斯克

  • 特朗普

  • 黄仁勋

  • Sam Altman

  • 某个行业 CEO

  • 某个关键政策人物

适合抓的不是八卦,而是:

  • 公开表态

  • 采访

  • 发布会

  • 政策相关动作

  • 对市场或行业有影响的言论

如果一个人的动态会持续影响行业、公司或市场,这种跟踪就很有价值。

4. 某个重大事件

比如:

  • 地缘冲突

  • 重大政策变化

  • 某国选举

  • 某项法案推进

  • 某个公共危机事件

这类任务和伊朗新闻更新最像,重点不在“搜全网”,而在“把新增进展持续接到同一条时间线上”。

5. 某个垂直主题的长期观察

比如:

  • 某个产品发布节奏

  • 某类技术栈更新

  • 某个开源项目动态

  • 某类供应链变化

  • 某个国家市场环境变化

这类主题通常关键词比较稳定,非常适合先用低成本入口做第一层抓取。


十一 一个简单判断方法

如果你不确定该不该用这种方案,可以先问自己两个问题:

问题 1:主题是不是固定的?

如果是固定主题,比如“跟踪 Tesla 动态”“盯 AI 行业新闻”“看某地缘事件进展”,那就很适合。

如果你每天搜的东西都不一样,那它更像研究任务,不像追踪任务。

问题 2:你要的是“持续追踪”,还是“深度研究”?

  • 如果你要的是持续追踪,优先考虑 web_fetch + 固定新闻入口

  • 如果你要的是深度研究,优先考虑 web_search / Tavily / Exa

这个区分很重要。

持续追踪讲的是频率、稳定、成本控制。深度研究讲的是召回质量、语义能力和综合分析。

别把两种任务混成一种。

十二 不同场景的关键词写法示例

如果你想把这套方法直接复刻到别的场景,一个很实用的做法是:先把搜索词写对。

原则很简单:

  • 尽量用英文关键词

  • 先写主体,再补事件词

  • 不要一上来写太长的自然语言句子

  • 先保证稳定召回,再慢慢加限定词

下面给几个常见场景的写法示例。

1. 跟踪某个大公司

比如追踪 Tesla:

Tesla earnings OR product launch OR regulatory OR layoffs

比如追踪 NVIDIA:

NVIDIA earnings OR AI chip OR regulation OR partnership

这种写法适合盯:

  • 财报

  • 产品发布

  • 监管变化

  • 合作与投资

  • 裁员和组织变化

2. 跟踪某个行业

比如 AI 行业:

AI industry regulation funding model launch acquisition

比如半导体行业:

semiconductor industry chip export regulation fab investment

这种写法适合拿行业层面的连续变化,后面很适合接股票分析、行业研究或周报整理。

3. 跟踪某个名人或关键人物

比如马斯克:

Elon Musk interview statement Tesla xAI SpaceX

比如 Sam Altman:

Sam Altman OpenAI interview statement policy

人物类关键词不要只写名字,最好再补:

  • interview

  • statement

  • policy

  • launch

  • lawsuit

  • earnings

这样结果会更聚焦在“有影响力的公开动态”。

4. 跟踪某个重大事件

比如地缘冲突:

Iran Israel US conflict

比如某国选举:

US election campaign polling debate court ruling

事件类关键词更适合保持短一点,重点是让新闻入口先把候选结果稳定拉回来。

5. 跟踪某个垂直主题

比如开源项目动态:

OpenAI open source model release benchmark developer

比如供应链变化:

global supply chain disruption shipping cost tariff factory

这类关键词更适合长期观察,不需要每天换写法。


十三 一个小建议

如果是第一次搭任务,不要试图一开始就把关键词写到“完美”。

更实用的顺序是:

  1. 先写一个偏宽的版本,保证能稳定抓到结果

  2. 连续观察几次返回内容

  3. 再加限定词,慢慢收窄

  4. 最后把稳定版固定进任务文档

这样比一开始就拼命调搜索词更稳。

十四 国内如果用不了 Google News,可以用哪些替代

这也是一个很实际的问题。

如果你的网络环境不适合直接使用 Google News,也不代表这套方法就不能用了。核心思路不变:先找一个稳定、低成本、适合固定主题追踪的入口,作为第一层候选信息来源。

可以考虑下面几类替代。

1. 国内主流新闻聚合页

比如:

  • 百度新闻

  • 搜狐新闻搜索

  • 腾讯新闻搜索

  • 网易新闻搜索

  • 今日头条搜索结果页

这类入口的优点是:

  • 国内访问更稳定

  • 对中文主题更友好

  • 热点类、政策类、本地类信息覆盖往往不错

但要注意:

  • 结果质量可能受推荐机制影响更大

  • 不同平台页面结构变化更频繁

  • 有些平台更适合人工看,不一定适合长期稳定抓取

所以这类入口更适合做:

  • 国内公司动态

  • 国内行业新闻

  • 政策变化

  • 本地热点事件

2. 官方网站 / 官方公告页

如果你盯的是固定对象,这类入口往往比新闻聚合更稳。

比如:

  • 公司官网新闻页

  • Investor Relations 页面

  • 交易所公告页

  • 监管机构公告页

  • 政府部门新闻发布页

  • 行业协会公告页

这种方式特别适合:

  • 上市公司动态

  • 政策跟踪

  • 行业监管变化

  • 官方口径优先的场景

优点是信息源更干净,误差更小。缺点是覆盖面不如聚合站,需要你自己多维护几个入口。

3. RSS / Atom 源

如果目标站点提供 RSS,这是很省心的一类来源。

适合:

  • 固定媒体

  • 固定博客

  • 固定公告页

  • 固定资讯网站

优点是结构稳定、抓取简单、适合定时任务。缺点是并不是所有站点都提供 RSS。

4. 垂直行业站点

如果你盯的是某个很明确的行业,直接找行业媒体或垂直资讯站,往往比大而全的平台更好。

比如:

  • 科技媒体

  • 财经媒体

  • 医药行业站

  • 物流行业站

  • 半导体行业站

这种方式的优点是噪音更少,缺点是覆盖面没那么广,更适合作为第二层或补充来源。

5. 有额度的搜索 API 作为补充,而不是默认入口

如果 Google News 不方便,国内可稳定直连的低成本入口又不够理想,那也可以退一步:

  • 把搜索 API 留给少量高价值任务

  • 或只在候选结果不足时再触发

也就是说,不一定完全不用搜索 API,但最好别把它设成所有高频任务的默认入口。


十五 一个替代方案的选择顺序

如果在国内环境下做这类任务,我更建议按这个顺序选:

  1. 先看有没有官方公告页或官网新闻页如果有,优先用这个,最稳。

  2. 再看有没有 RSS如果有 RSS,通常也很适合做定时跟踪。

  3. 再考虑新闻聚合页比如百度新闻、头条搜索等,适合做更宽一点的候选信息入口。

  4. 最后再考虑高频调用搜索 API这一步不是不能用,而是要算好成本。

这个顺序的核心是:

先选稳定、便宜、结构清楚的入口;把贵的、强的能力留到后面。


十六 一个简单判断标准

如果你在两个替代方案之间犹豫,可以用这 4 个问题快速判断:

  • 这个入口访问稳不稳?

  • 结构变动频不频繁?

  • 主题够不够聚焦?

  • 长期跑起来成本高不高?

四个里只要前 3 个都比较差,就不适合做定时任务的默认入口。

反过来,如果:

  • 访问稳定

  • 页面结构相对固定

  • 主题聚焦

  • 成本低

那它就很适合拿来做第一层候选来源。

十七 不同替代入口分别适合什么任务

这一节可以直接当“选型对照表”。

1. 公司官网 / 官方公告页

适合:

  • 财报

  • 高管变动

  • 重大合作 / 收购

  • 监管处罚 / 合规公告

优点:权威、稳定、噪音少。

2. 交易所 / 监管机构公告页

适合:

  • 上市公司公告

  • 监管政策变化

  • 行业合规通知

优点:时效性高、信息可信。

3. 新闻聚合页(百度新闻 / 头条 / 腾讯 / 网易)

适合:

  • 热点事件追踪

  • 舆情动态

  • 大范围行业新闻

优点:覆盖面广,热点信息容易出现。

4. RSS / Atom 源

适合:

  • 固定媒体

  • 固定博客

  • 固定资讯站

优点:结构稳定、抓取成本低,特别适合长期监控。

5. 垂直行业媒体 / 行业站点

适合:

  • 细分赛道的长期观察

  • 供应链 / 产业链变化

  • 专业政策、行业趋势

优点:噪音少、信息更聚焦。

6. 搜索 API(作为补充)

适合:

  • 开放式研究

  • 深度检索

  • “入口无法覆盖”的补充搜索

优点:召回能力强,适合少量高价值任务。


十八 一个简单选型口诀

如果只记一句话:

优先官方 / RSS,再用聚合页,搜索 API 只在必要时出场。