Skip to content

Argo v2.7.2

Choose a tag to compare

@taxueseek taxueseek released this 07 Aug 12:49
· 40 commits to main since this release

Argo v2.7.2 发布说明

版本:2.7.2
定位:在 2.7.1 基础上,新增「登录态专业搜索」子技能,并系统改进了搜索路由和服务层。


现在具备的几种搜索能力

1. 通用搜索 + 垂直搜索,双管齐下

日常问题走通用网页搜索;一问到行情、影视、体育、宏观这类「有标准答案」的问题,自动切到垂直源直接给答案,而不是扔给你一堆链接。目前约 120+ 个源、60+ 业务域。

2. 缓存:不重复花冤枉钱

时效性没那么强的内容(百科类、历史数据这类),第一次查完会进缓存,之后同样的查询直接命中,不再每次都走一遍 API。双层缓存(内存 + SQLite),热查询约 10ms 级返回。

3. 专为 Agent 设计,更省 Token

产出是「证据候选 + 可信度分解」的精简 JSON,不是长篇网页;MCP 响应可以按需裁剪,snippet 可控,不会撑爆 Agent 的上下文。比常规模型自带的搜索能力更专业、更省 Token。

4. 深度研究

把一个笼统的问题拆成多个子问题,多源并行采集,最后给出「还差什么证据」的缺口提示。适合综述、调研这类要全面、要扎实的场景。

5. 登录态专业搜索(专业模式,默认关闭)

知乎、小红书、公众号这类要登录才能看的内容,以及 JS 渲染页、反爬页,用真实浏览器配合登录态去搜。默认关闭,需要时开启,依赖 ego lite 和 WebBridge 两个东西,详见下文第 1 节。


这次更新有什么

1. 新增 ego-search:登录态专业搜索(默认关闭)

以前:知乎、小红书、微博、公众号这类需要登录才能看的内容,普通搜索拿不到正文;靠浏览器渲染的页面(JS 页面、反爬页、SPA)也经常抓不回来。

现在:新增 ego-search 子技能,用真实浏览器去搜这些内容。它能继承你的登录状态,抓到登录墙后面的正文;对渲染页、反爬页也能正常抓取;还能在已登录的站点里直接调它的接口拿数据(比如知乎搜索接口),比翻页面更干净。

注意:这个子技能默认是关闭的,因为要动真实浏览器和你的登录态。需要你明确要求开启后,运行下面这条命令(在 argo 目录下):

python3 sub-skills/ego-search/scripts/ego_search.py enable

开启之后,常用操作:

# 用浏览器去搜索(bing/baidu/google 三个搜索引擎可选)
python3 sub-skills/ego-search/scripts/ego_search.py search "AI agent 浏览器自动化" --engine bing --n 8

# 抓一个页面正文(登录墙、JS 渲染页都行)
python3 sub-skills/ego-search/scripts/ego_search.py fetch "https://example.com/article" --focus 关键词

# 调登录站点自己的接口拿数据
python3 sub-skills/ego-search/scripts/ego_search.py api "https://www.zhihu.com/api/v4/search_v3?t=general&q=AI代理&limit=5" --origin "https://www.zhihu.com"

查看状态:python3 sub-skills/ego-search/scripts/ego_search.py status;关闭:python3 sub-skills/ego-search/scripts/ego_search.py disable

它依赖两个东西(装好其中一个就能用,两个都装更好):

依赖 是什么 什么时候用
ego lite 一个专门给 Agent 用的浏览器应用(仅 macOS),装好并完成一次初始化后会提供 ego-browser 命令 默认首选。它的优势是每个任务用独立空间,不抢你正在用的浏览器标签页
WebBridge 一个浏览器扩展桥,可以复用你 Chrome/Edge 里已经登录的会话 ego lite 没装,或想直接沿用你日常浏览器的登录态时用

本机两个依赖都已装好:ego lite 的 ego-browser(版本 0.4.5.9)和 WebBridge 均在线,专业搜索模式默认关闭。

一个使用提醒:登录态搜到的结果不会写入公共搜索缓存(防止污染大家共享的缓存),需要时用专门的合并命令把常规结果和登录态结果放在一起分析。

2. 搜索兜底更稳了

以前:微信公众号、财联社、同花顺、知乎热榜、Stack Overflow、V2EX 等 16 个垂直源,主引擎故障时整次搜索跟着失败。

现在:主引擎出问题时,会自动切到通用的免费搜索源顶上,单个源故障不再拖垮整个查询。

3. 路由更聪明

  • 多意图识别:一次查询可以同时判断是查定义、查事实、查新闻、做对比,还是看社交舆情,不同意图用不同的引擎数量和并发方式。
  • 统一健康视图:所有引擎的健康状态汇总成一张统一视图;免费源作为单一真源统一管理;故障后的恢复手段分层次、更完整。

4. 多语言搜索更准

  • 日文/韩文查询不再被中文引擎干扰:以前搜日文内容会混进博查、字节、搜狗等中文引擎,噪声很大;现在会自动剔除。
  • 显式指定语言生效:说「用日文搜」「in English」这类话,会真的按那个语言去搜,而不是按默认语言处理。
  • 语言参数有测试锁定:Bing 的 setlang、Google 的 hl 等 URL 语言参数全部有自动化测试守着,不会悄悄失效。

5. 服务层拆得更清爽

  • MCP 服务文件从 970 行拆成「工具定义 / 执行逻辑 / 网络传输」三个模块,10 个工具一个不少、行为不变,只是结构更好维护。
  • 启动预热覆盖到了本地文件搜索模块,首次调用更快。

6. 具备安全防护

  • 登录态结果与公共缓存隔离:登录态搜到的内容不写入公共搜索缓存,防止污染大家共享的数据。
  • 抓取前 URL 安全检查:ego-search 抓取前会做 URL 白名单与 IP 段校验,防止恶意链接诱导访问内网或云元数据地址。
  • 异常只记本地日志:出异常时仅记录本地日志便于排查,可整体开关,不影响搜索本身。

验证

  • 全量测试:497 passed,无失败。
  • 10 个 MCP 工具与 2.7.1 完全一致,没有回退。