网页读取提速 60 倍、成本砍到 1/49:Hermes Agent 是怎么做到的

lxiol

原文链接:https://mp.weixin.qq.com/s/voXdbX6rjkxv8rZQoqqjiQ

Hermes 网页读取速度提升 60 倍,成本降 49 倍。

主判断:60 倍速、49 倍成本不是某个模型变快了,而是“谁去抓网页、抓完怎么存、怎么按需分页”这整条管线的架构变化。对普通用户来说,真正值得关心的不是数字本身,而是这套机制能不能绕过反爬、会不会让你陷入灰产边界。

60x / 49x

官方宣称的速率与成本倍率

本地分页 + 专用抓取后端

实现路径,不是模型加速

真实浏览器 + 托管节点池

绕过反爬的实际手段

这数字到底在说什么

Nous Research 在 X 上发帖说,Hermes Agent 读取网页的速度现在最高提升 60 倍,成本下降 49 倍。这更像产品文案,不是 benchmark 表格。能确认的是,官方把功劳归到了“抓取后端直接向代理传递干净内容”以及“大页面本地保存、按需分页”这两件事上。

先说透:这不是某个模型推理速度变快了,而是谁来处理网页、处理完怎么缓存、什么时候再处理这整条浏览管线的重构。模型本身的速度、输入文本长度都直接影响响应时间;如果能把脏 HTML 在进入模型之前就裁成干净的正文,再切成按需分页,整体吞吐量就会上升。

普通用户的体感是什么

如果你直接让 Hermes 去读一个 20MB 的电商列表页,之前的流程大概率是:抓到的 HTML 直接扔给模型,模型被广告、导航、追踪脚本挤爆,最后给你一个错误答案或者超时。新流程把抓取后端和模型解耦,大页面先落盘,再按需切页,你看到的只是“同样的页面,它更快给了一个更准的答案”。

我实测下来的判断是:体感提速取决于你读什么。读新闻长文、博客这类单页主体明确的,获益最大。读强交互页面(需要滚动、点击、登录后才能看到评论的社交站),效果取决于站点是否把内容藏在客户端渲染之后。如果内容被 JS 延迟加载,管线再快也快不起来。

[反主流] 主流宣传会把这说成“Agent 能力跃迁”。我不同意。这本质上是I/O 架构优化,不是模型能力提升。把它包装成“Agent 更聪明了”会误导用户以为换模型就能复现;实际上,复现条件是一整套后端基础设施,包括抓取节点池、本地缓存、分页策略。

反爬这件事到底怎么解

先说结论:服务器阻拦自动化请求是常态,不是例外。直接让 requests 加 UA 去抓绝大多数主流网站,基本在 5 秒内被 403 或 Cloudflare 验证码拦下。

Hermes 走的是托管抓取后端这条路线。它的 bundle 里提供了 web search、browser、vision、TTS 这些工具,你不用自己维护浏览器实例,也不用自己买代理 IP;这些由 Nous Portal 统一订阅。也就是说,绕过反爬的主体不是你自己,而是 Nous 运营的抓取节点池。

这种模式的好处是你能用,而且大概率比自己去配 Playwright + 住宅代理 + 指纹浏览器稳定。坏处是你没办法完全掌控:节点池被封了、速率被限了,你只能等官方修,没有自愈能力。

Chrome 插件那一套又是什么

如果你用过类似“打开社交网站信息流”的 Chrome 插件或扩展,原理是真实用户浏览器里的 Cookie 和登录态被插件直接读取。社交平台看到的是一个真的 Chrome 实例在访问页面,不是一个 Python 脚本。

这比纯云抓取节点更适合需要登录的站点,因为你的账号权限也被复用了。代价是插件必须运行在你本机或你控制的浏览器环境里,不能丢给第三方服务。Hermes 的 browser 工具走的是独立无头浏览器,不继承你的登录态;这层边界决定了它在需要登录的内容面前天然有盲区。

灰产这个问题没法绕过

公开网页抓取处在版权法、计算机欺诈与滥用法、平台服务条款的三重边界里。很多站点的 robots.txt 明确禁止自动化采集;部分司法管辖区把绕过技术保护措施视为违法。

Hermes 的做法是把风险从用户端转移到服务端:Nous 自己运营节点池,承担被封 IP、被站点拉黑的法律和运营成本。普通用户不需要亲自处理验证码,但也不等于这件事合规。如果你用这套工具去读付费墙内容、个人隐私页面,或者明显违反站点条款的批量采集,责任还是落到你自己头上。

成本判断:这是“工具层面的速度提升”,不是“爬虫技术突破”。如果你需要在生产环境稳定访问几十个外部站点,不要把 Hermes 当作零配置方案;反过来,如果你只是偶尔读公开长文、做研究汇总,它把抓取-清洗-分页打包成一个可用管线,确实减少了你自己组装的成本。

适合谁,不适合谁

适合:已经接受 SaaS 式网页抓取、需要把公开网页汇总给 Agent 做研究、不愿为验证码和 Cookie 维护操心的人。

不适合:需要细粒度控制抓取头、代理 IP、指纹设置,对站点合规性敏感,或站点体量太大以至于会被批量 IP 封禁的团队。

来源:NousResearch, “Hermes Agent now reads the web up to 60x faster and 49x cheaper”, X/Twitter, 2026-06-30 · NousResearch / hermes-agent, docs.hermes-agent.nousresearch.com, GitHub

本文转载自微信公众号,如有侵权请联系删除。

  • 标题: 网页读取提速 60 倍、成本砍到 1/49:Hermes Agent 是怎么做到的
  • 作者: lxiol
  • 创建于 : 2026-07-06 10:48:27
  • 更新于 : 2026-07-06 10:48:27
  • 链接: https://blog.lxiol.cn/2026/07/06/网页读取提速-60-倍成本砍到-149Hermes-Agent-是怎么做到的/
  • 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。