Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来
打开Grok Bot或Hermes Bot Mode,界面上都是带名字、带角色、能记事、能连工具、能后台跑任务的AI队友。过去一周,两边被反复放在一起比较,理由看起来很充分:都在把聊天变成派活。
可真正拉开差距的,从来不是你能建多少个Bot,也不是界面上的群聊有多热闹。差距藏在执行发生在哪里、状态存在哪里、模型栈用户能控多少、可复用能力到底是什么、以及Agent被允许怎样与外部系统说话。
产品层在趋同。架构层在做两种截然不同的长期赌注。
我起初也顺着表面去比“谁Bot更多、谁记忆更强”。后来对照Cursor/SpaceXAI与Nous Research的第一方文档,再亲手跑通一次Hermes的A2A实验后才看清:一边在给你一台托管好的电脑,另一边在给你一套可以自己摆放的运行时。
托管电脑与可配置运行时 两种抽象层级的根本分叉
Grok Bot的文档描述得很直白:持久化Agent、连接插件、在云电脑里操作、记住上下文、跑例程、用户离开后继续工作。没有插件的服务就用云电脑上的浏览器。执行环境主要由产品提供。你建Agent、连服务、认证、描述结果,剩下的底层机器大多交给托管环境。
Hermes走的是几乎相反的方向。它开源、MIT许可,能在Windows、macOS、Linux/WSL或Docker里原生跑。模型层可配置,而不是绑死在单一提供商。核心抽象不是“一个有电脑的Bot”,而是“一套你能自己配置组件的Agent运行时”——模型选择、工具、记忆、技能、Profile、网关、执行后端全部暴露。
Grok Bot把Agent放进托管电脑。
Hermes把运行时交给你,让你放进自己控制的环境。
这不是好坏判断,只是抽象层级的选择。就像一个给你配好全套工具的现成工作室,另一个给你一套可拆卸的机床,让你决定放在哪间厂房、接哪条电源。
Profile如何把“名字不同”变成真正的状态边界
在Hermes里,Profile是独立的home目录。每个Profile可以有自己的配置、API密钥、SOUL.md、记忆、会话、技能、定时任务、状态数据库和网关状态。两个Bot因此不必是同一个Agent换了个名字。
你可以让一个Profile专门做研究:研究向模型、网络访问、研究技能、独立记忆与状态;另一个做实现:编码向模型、终端与文件工具、不同技能与记忆。这比换头像或系统提示有意义得多。
但官方文档也明确提醒:状态隔离不等于执行隔离。Profile状态与终端工作目录是两回事。不同home不会自动给每个命令套上操作系统级沙箱。把每个Hermes Bot都叫“完全隔离”并不准确。
模型自由不是功能清单上的勾选
常见说法是“Grok用Grok,Hermes支持很多模型”。精神对,但漏了更重要的架构点。
Hermes把Agent与所用模型分开。配置系统有主模型槽位,还有独立的辅助模型槽位,分别处理压缩、视觉、网页摘要、审批打分、MCP路由、技能搜索。这些可以单独配置。Nous Portal目前列出300+模型,也支持直接提供商和本地端点。
Agent身份不必等于模型身份。一个持久化研究Agent今天用一个模型,明天换另一个,它依然是那个Agent。不同Agent也可以按岗位分配不同模型。
当前公开的Grok Bot文档里,我没找到对等的、面向用户的模型路由层。这不证明Grok Bot内部不能用不同模型,只说明Hermes把模型选择暴露成了操作员可控的原语,而Grok Bot目前把这一层抽象得更远。
真正的长期资产可能是技能库 而不是对话历史
两边都指向同一方向的大转移:有用的Agent不该每次从零重新发现工作流。
Hermes把Skills当作可复用的程序性知识,支持可安装能力与明确的技能工件,并对第三方技能安装做了安全扫描。Grok Bot的公开文档强调持久化Agent、插件与能跨会话继续工作的例程。
实现不同,方向相似:成功行为应该变成可复用行为。
比“谁记忆更好”更有意思的问题是——如果Agent智能的耐久单位最终不是对话历史,而是它知道如何调用的有用程序库呢?围绕Agent Skills的竞争,才会真正变得关键。
A2A如何改写“多Agent”的含义
这是我亲手测过的部分。
Hermes实现了开放的Agent2Agent协议v1.0。文档写明:Hermes Agent既能调用外部A2A对等体,也能接收来自它们的任务。互操作不限于另一个Hermes实例,兼容LangChain、CrewAI、Google ADK以及基于官方A2A SDK的实现。
这打开了完全不同的可能:不是产品内部的Agent A → Agent B,而是Hermes → 另一个进程 → 另一台机器 → 另一个框架,交接发生在协议边界。
官方也提醒:A2A主要推荐用于跨进程、跨机器或跨框架。同一台机器上的多个Agent,很多时候用更简单的原生委托或看板式工作队列就够。
我故意在Bot Mode里把一个工作流拆成三个故意不完整的角色:
Research Intelligence 能协调,但不实现
↓
Implementation Engineer 能构建,但不负责审批自己的工作
↓
Verification Auditor 能独立测试结果
第一次消息没有魔法般成功。A2A对等体最初需要配置,一条早期消息因为结构问题被拒为空任务。修正后,Implementation Engineer回了PONG_OK,确认通信通了。真正规格被交接过去,Implementation Engineer产出了Python Capability Risk Inspector,结果交给Verification Auditor。
Auditor跑了十个测试,包括正常组合、边界与对抗用例。全部通过。
有趣的不是那个工件,而是通信本身成了职责分离的一部分。这些Agent之所以一起有用,恰恰因为没有一个被设计成拥有整个工作流。这和把几个Bot扔进同一个聊天室,是完全不同的思路。
开放互操作与产品原生协作不是一回事
Grok Bot明显围绕多个持久化AI队友与真实工具使用来设计。但我没有找到公开文档证明它有与Hermes A2A对等的开放外部Agent间互操作层。
这不代表内部不存在,也不代表永远不会有。只是今天可验证的差异更窄:Hermes公开暴露基于标准的A2A互操作;Grok Bot的文档优势在于围绕持久化Agent、插件、浏览器使用与例程的托管产品环境。
够清楚,不必发明更强的对立。
安全边界在移动 而不是消失
Grok Bot的Agent能作用于真实账号、文件和网站。Cursor明确警告这种权限,建议用户自己登录Grok Bot电脑,并警告不要把API密钥和凭证放在普通聊天或文件里。
Hermes让操作员对执行位置与状态分离有更多控制,但也增加了配置责任。不同Profile并不自动等于不同操作系统级沙箱。A2A层因此内置了明确安全控制:默认无localhost、按对等体认证、入站消息的提示注入过滤、出站凭证脱敏、速率限制与审计相关身份处理。
结论不是一边天生安全、一边天生不安全。而是它们把信任放在系统的不同部分。Grok Bot把更多安全责任集中在托管产品里;Hermes让更多安全边界由操作员配置——控制更多,也更容易配错。
定价不是简单的“300美元对免费”
截至2026年8月20日,Cursor文档写明个人持续使用Grok Bot包含在Cursor Ultra里。Pro和Pro Plus不含;合格的团队席位是另一条路径。Cursor Ultra目前200美元/月。SuperGrok Heavy订阅者有一个访问促销:符合条件的用户获得一个月免费Cursor Ultra,但不会因为继续订SuperGrok Heavy而重复赠送。
所以“Grok Bot每月300美元”并不准确。更准确的说法是:个人用户目前通过200美元/月的Cursor Ultra订阅获得访问,另有其他合格路径。
Hermes Agent本身是0美元软件、开源、MIT。但运行它并不免费。你仍需要执行环境和某种模型推理——现有电脑、VPS、本地模型硬件、API用量、OpenRouter、Nous Portal或其他提供商。
成本曲线完全不同:没有强制软件许可费,但基础设施与推理成本由用户选择、随工作负载变化。对某些人可以极便宜,对另一些人可能更复杂甚至更贵。没有指定工作负载和模型栈,就没有诚实的“Hermes成本”单一数字。
我真正会用的对比维度
| 维度 | Grok Bot当前可验证特征 | Hermes当前可验证特征 |
|---|---|---|
| 执行环境 | 产品提供的托管云电脑 | 用户可控的运行时(本地/Docker/SSH等) |
| 状态边界 | 账号级共享云电脑与会话 | Profile级独立home目录与配置 |
| 模型控制 | 更多抽象在产品内部 | 主模型+辅助模型槽位可独立配置 |
| 可复用能力 | 插件、例程、持久化Agent | 可安装Skills与安全扫描 |
| 多Agent通信 | 产品内群聊与协调 | 公开A2A协议,跨框架/跨机器 |
| 安全责任 | 更多集中在托管产品 | 更多由操作员配置 |
| 成本结构 | 捆绑在200美元/月Cursor Ultra等 | 软件免费,基础设施与推理自选 |
两边都在优化“AI队友”的不同定义。
Grok Bot在做产品赌注:给Agent一台持久电脑,连上用户工作环境,保持可用,并尽量藏起基础设施。
Hermes在做运行时赌注:让操作员选择模型、执行环境、状态边界、工具、技能,甚至越来越多地选择Agent通信协议。
更简单地说:Grok Bot试图去掉操作摩擦;Hermes试图去掉架构锁定。
想派真实工作、又不想自己运营Agent栈的人,Grok Bot的路径可能正好对。
想组合Agent、换模型、检查状态、控制能力、并跨开放边界连接Agent的人,Hermes会有趣得多。
市场最终不必只选一种哲学。界面可能继续收敛,两边都看起来像一排等待派活的AI队友。可名单不是架构。当这些Agent开始持有凭证、控制电脑、积累技能、委托权限并把任务发给其他Agent时,界面底下坐着什么,才会成为产品最重要的部分。
你现在更在意去掉操作摩擦,还是去掉架构锁定?如果已经同时试过两边,哪一层的差异真正影响了你的日常工作流?
我是紫微AI,在做一个「人格操作系统(ZPF)」。后面会持续分享AI Agent和系统实验。感兴趣可以关注,我们下期见。