# Argo v2.7.2 发布说明 **版本**:2.7.2 **定位**:在 2.7.1 基础上,新增「登录态专业搜索」子技能,并系统改进了搜索路由和服务层。 --- ## 现在具备的几种搜索能力 **1. 通用搜索 + 垂直搜索,双管齐下** 日常问题走通用网页搜索;一问到行情、影视、体育、宏观这类「有标准答案」的问题,自动切到垂直源直接给答案,而不是扔给你一堆链接。目前约 120+ 个源、60+ 业务域。 **2. 缓存:不重复花冤枉钱** 时效性没那么强的内容(百科类、历史数据这类),第一次查完会进缓存,之后同样的查询直接命中,不再每次都走一遍 API。双层缓存(内存 + SQLite),热查询约 10ms 级返回。 **3. 专为 Agent 设计,更省 Token** 产出是「证据候选 + 可信度分解」的精简 JSON,不是长篇网页;MCP 响应可以按需裁剪,snippet 可控,不会撑爆 Agent 的上下文。比常规模型自带的搜索能力更专业、更省 Token。 **4. 深度研究** 把一个笼统的问题拆成多个子问题,多源并行采集,最后给出「还差什么证据」的缺口提示。适合综述、调研这类要全面、要扎实的场景。 **5. 登录态专业搜索(专业模式,默认关闭)** 知乎、小红书、公众号这类要登录才能看的内容,以及 JS 渲染页、反爬页,用真实浏览器配合登录态去搜。默认关闭,需要时开启,依赖 ego lite 和 WebBridge 两个东西,详见下文第 1 节。 --- ## 这次更新有什么 ### 1. 新增 ego-search:登录态专业搜索(默认关闭) **以前**:知乎、小红书、微博、公众号这类需要登录才能看的内容,普通搜索拿不到正文;靠浏览器渲染的页面(JS 页面、反爬页、SPA)也经常抓不回来。 **现在**:新增 ego-search 子技能,用真实浏览器去搜这些内容。它能继承你的登录状态,抓到登录墙后面的正文;对渲染页、反爬页也能正常抓取;还能在已登录的站点里直接调它的接口拿数据(比如知乎搜索接口),比翻页面更干净。 **注意:这个子技能默认是关闭的**,因为要动真实浏览器和你的登录态。需要你明确要求开启后,运行下面这条命令(在 argo 目录下): ``` python3 sub-skills/ego-search/scripts/ego_search.py enable ``` 开启之后,常用操作: ``` # 用浏览器去搜索(bing/baidu/google 三个搜索引擎可选) python3 sub-skills/ego-search/scripts/ego_search.py search "AI agent 浏览器自动化" --engine bing --n 8 # 抓一个页面正文(登录墙、JS 渲染页都行) python3 sub-skills/ego-search/scripts/ego_search.py fetch "https://example.com/article" --focus 关键词 # 调登录站点自己的接口拿数据 python3 sub-skills/ego-search/scripts/ego_search.py api "https://www.zhihu.com/api/v4/search_v3?t=general&q=AI代理&limit=5" --origin "https://www.zhihu.com" ``` 查看状态:`python3 sub-skills/ego-search/scripts/ego_search.py status`;关闭:`python3 sub-skills/ego-search/scripts/ego_search.py disable`。 **它依赖两个东西**(装好其中一个就能用,两个都装更好): | 依赖 | 是什么 | 什么时候用 | |------|--------|-----------| | **ego lite** | 一个专门给 Agent 用的浏览器应用(仅 macOS),装好并完成一次初始化后会提供 `ego-browser` 命令 | 默认首选。它的优势是每个任务用独立空间,不抢你正在用的浏览器标签页 | | **WebBridge** | 一个浏览器扩展桥,可以复用你 Chrome/Edge 里已经登录的会话 | ego lite 没装,或想直接沿用你日常浏览器的登录态时用 | 本机两个依赖都已装好:ego lite 的 `ego-browser`(版本 0.4.5.9)和 WebBridge 均在线,专业搜索模式默认关闭。 一个使用提醒:登录态搜到的结果**不会**写入公共搜索缓存(防止污染大家共享的缓存),需要时用专门的合并命令把常规结果和登录态结果放在一起分析。 ### 2. 搜索兜底更稳了 **以前**:微信公众号、财联社、同花顺、知乎热榜、Stack Overflow、V2EX 等 16 个垂直源,主引擎故障时整次搜索跟着失败。 **现在**:主引擎出问题时,会自动切到通用的免费搜索源顶上,单个源故障不再拖垮整个查询。 ### 3. 路由更聪明 - **多意图识别**:一次查询可以同时判断是查定义、查事实、查新闻、做对比,还是看社交舆情,不同意图用不同的引擎数量和并发方式。 - **统一健康视图**:所有引擎的健康状态汇总成一张统一视图;免费源作为单一真源统一管理;故障后的恢复手段分层次、更完整。 ### 4. 多语言搜索更准 - **日文/韩文查询不再被中文引擎干扰**:以前搜日文内容会混进博查、字节、搜狗等中文引擎,噪声很大;现在会自动剔除。 - **显式指定语言生效**:说「用日文搜」「in English」这类话,会真的按那个语言去搜,而不是按默认语言处理。 - **语言参数有测试锁定**:Bing 的 setlang、Google 的 hl 等 URL 语言参数全部有自动化测试守着,不会悄悄失效。 ### 5. 服务层拆得更清爽 - MCP 服务文件从 970 行拆成「工具定义 / 执行逻辑 / 网络传输」三个模块,10 个工具一个不少、行为不变,只是结构更好维护。 - 启动预热覆盖到了本地文件搜索模块,首次调用更快。 ### 6. 具备安全防护 - **登录态结果与公共缓存隔离**:登录态搜到的内容不写入公共搜索缓存,防止污染大家共享的数据。 - **抓取前 URL 安全检查**:ego-search 抓取前会做 URL 白名单与 IP 段校验,防止恶意链接诱导访问内网或云元数据地址。 - **异常只记本地日志**:出异常时仅记录本地日志便于排查,可整体开关,不影响搜索本身。 --- ## 验证 - 全量测试:**497 passed**,无失败。 - 10 个 MCP 工具与 2.7.1 完全一致,没有回退。