news 2026/8/22 2:10:04

Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来

Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来

打开Grok Bot或Hermes Bot Mode,界面上都是带名字、带角色、能记事、能连工具、能后台跑任务的AI队友。过去一周,两边被反复放在一起比较,理由看起来很充分:都在把聊天变成派活。

可真正拉开差距的,从来不是你能建多少个Bot,也不是界面上的群聊有多热闹。差距藏在执行发生在哪里、状态存在哪里、模型栈用户能控多少、可复用能力到底是什么、以及Agent被允许怎样与外部系统说话。

产品层在趋同。架构层在做两种截然不同的长期赌注。

我起初也顺着表面去比“谁Bot更多、谁记忆更强”。后来对照Cursor/SpaceXAI与Nous Research的第一方文档,再亲手跑通一次Hermes的A2A实验后才看清:一边在给你一台托管好的电脑,另一边在给你一套可以自己摆放的运行时。

托管电脑与可配置运行时 两种抽象层级的根本分叉

Grok Bot的文档描述得很直白:持久化Agent、连接插件、在云电脑里操作、记住上下文、跑例程、用户离开后继续工作。没有插件的服务就用云电脑上的浏览器。执行环境主要由产品提供。你建Agent、连服务、认证、描述结果,剩下的底层机器大多交给托管环境。

Hermes走的是几乎相反的方向。它开源、MIT许可,能在Windows、macOS、Linux/WSL或Docker里原生跑。模型层可配置,而不是绑死在单一提供商。核心抽象不是“一个有电脑的Bot”,而是“一套你能自己配置组件的Agent运行时”——模型选择、工具、记忆、技能、Profile、网关、执行后端全部暴露。

Grok Bot把Agent放进托管电脑。
Hermes把运行时交给你,让你放进自己控制的环境。

这不是好坏判断,只是抽象层级的选择。就像一个给你配好全套工具的现成工作室,另一个给你一套可拆卸的机床,让你决定放在哪间厂房、接哪条电源。

Profile如何把“名字不同”变成真正的状态边界

在Hermes里,Profile是独立的home目录。每个Profile可以有自己的配置、API密钥、SOUL.md、记忆、会话、技能、定时任务、状态数据库和网关状态。两个Bot因此不必是同一个Agent换了个名字。

你可以让一个Profile专门做研究:研究向模型、网络访问、研究技能、独立记忆与状态;另一个做实现:编码向模型、终端与文件工具、不同技能与记忆。这比换头像或系统提示有意义得多。

但官方文档也明确提醒:状态隔离不等于执行隔离。Profile状态与终端工作目录是两回事。不同home不会自动给每个命令套上操作系统级沙箱。把每个Hermes Bot都叫“完全隔离”并不准确。

模型自由不是功能清单上的勾选

常见说法是“Grok用Grok,Hermes支持很多模型”。精神对,但漏了更重要的架构点。

Hermes把Agent与所用模型分开。配置系统有主模型槽位,还有独立的辅助模型槽位,分别处理压缩、视觉、网页摘要、审批打分、MCP路由、技能搜索。这些可以单独配置。Nous Portal目前列出300+模型,也支持直接提供商和本地端点。

Agent身份不必等于模型身份。一个持久化研究Agent今天用一个模型,明天换另一个,它依然是那个Agent。不同Agent也可以按岗位分配不同模型。

当前公开的Grok Bot文档里,我没找到对等的、面向用户的模型路由层。这不证明Grok Bot内部不能用不同模型,只说明Hermes把模型选择暴露成了操作员可控的原语,而Grok Bot目前把这一层抽象得更远。

真正的长期资产可能是技能库 而不是对话历史

两边都指向同一方向的大转移:有用的Agent不该每次从零重新发现工作流。

Hermes把Skills当作可复用的程序性知识,支持可安装能力与明确的技能工件,并对第三方技能安装做了安全扫描。Grok Bot的公开文档强调持久化Agent、插件与能跨会话继续工作的例程。

实现不同,方向相似:成功行为应该变成可复用行为。

比“谁记忆更好”更有意思的问题是——如果Agent智能的耐久单位最终不是对话历史,而是它知道如何调用的有用程序库呢?围绕Agent Skills的竞争,才会真正变得关键。

A2A如何改写“多Agent”的含义

这是我亲手测过的部分。

Hermes实现了开放的Agent2Agent协议v1.0。文档写明:Hermes Agent既能调用外部A2A对等体,也能接收来自它们的任务。互操作不限于另一个Hermes实例,兼容LangChain、CrewAI、Google ADK以及基于官方A2A SDK的实现。

这打开了完全不同的可能:不是产品内部的Agent A → Agent B,而是Hermes → 另一个进程 → 另一台机器 → 另一个框架,交接发生在协议边界。

官方也提醒:A2A主要推荐用于跨进程、跨机器或跨框架。同一台机器上的多个Agent,很多时候用更简单的原生委托或看板式工作队列就够。

我故意在Bot Mode里把一个工作流拆成三个故意不完整的角色:

Research Intelligence 能协调,但不实现

Implementation Engineer 能构建,但不负责审批自己的工作

Verification Auditor 能独立测试结果

第一次消息没有魔法般成功。A2A对等体最初需要配置,一条早期消息因为结构问题被拒为空任务。修正后,Implementation Engineer回了PONG_OK,确认通信通了。真正规格被交接过去,Implementation Engineer产出了Python Capability Risk Inspector,结果交给Verification Auditor。

Auditor跑了十个测试,包括正常组合、边界与对抗用例。全部通过。

有趣的不是那个工件,而是通信本身成了职责分离的一部分。这些Agent之所以一起有用,恰恰因为没有一个被设计成拥有整个工作流。这和把几个Bot扔进同一个聊天室,是完全不同的思路。

开放互操作与产品原生协作不是一回事

Grok Bot明显围绕多个持久化AI队友与真实工具使用来设计。但我没有找到公开文档证明它有与Hermes A2A对等的开放外部Agent间互操作层。

这不代表内部不存在,也不代表永远不会有。只是今天可验证的差异更窄:Hermes公开暴露基于标准的A2A互操作;Grok Bot的文档优势在于围绕持久化Agent、插件、浏览器使用与例程的托管产品环境。

够清楚,不必发明更强的对立。

安全边界在移动 而不是消失

Grok Bot的Agent能作用于真实账号、文件和网站。Cursor明确警告这种权限,建议用户自己登录Grok Bot电脑,并警告不要把API密钥和凭证放在普通聊天或文件里。

Hermes让操作员对执行位置与状态分离有更多控制,但也增加了配置责任。不同Profile并不自动等于不同操作系统级沙箱。A2A层因此内置了明确安全控制:默认无localhost、按对等体认证、入站消息的提示注入过滤、出站凭证脱敏、速率限制与审计相关身份处理。

结论不是一边天生安全、一边天生不安全。而是它们把信任放在系统的不同部分。Grok Bot把更多安全责任集中在托管产品里;Hermes让更多安全边界由操作员配置——控制更多,也更容易配错。

定价不是简单的“300美元对免费”

截至2026年8月20日,Cursor文档写明个人持续使用Grok Bot包含在Cursor Ultra里。Pro和Pro Plus不含;合格的团队席位是另一条路径。Cursor Ultra目前200美元/月。SuperGrok Heavy订阅者有一个访问促销:符合条件的用户获得一个月免费Cursor Ultra,但不会因为继续订SuperGrok Heavy而重复赠送。

所以“Grok Bot每月300美元”并不准确。更准确的说法是:个人用户目前通过200美元/月的Cursor Ultra订阅获得访问,另有其他合格路径。

Hermes Agent本身是0美元软件、开源、MIT。但运行它并不免费。你仍需要执行环境和某种模型推理——现有电脑、VPS、本地模型硬件、API用量、OpenRouter、Nous Portal或其他提供商。

成本曲线完全不同:没有强制软件许可费,但基础设施与推理成本由用户选择、随工作负载变化。对某些人可以极便宜,对另一些人可能更复杂甚至更贵。没有指定工作负载和模型栈,就没有诚实的“Hermes成本”单一数字。

我真正会用的对比维度

维度Grok Bot当前可验证特征Hermes当前可验证特征
执行环境产品提供的托管云电脑用户可控的运行时(本地/Docker/SSH等)
状态边界账号级共享云电脑与会话Profile级独立home目录与配置
模型控制更多抽象在产品内部主模型+辅助模型槽位可独立配置
可复用能力插件、例程、持久化Agent可安装Skills与安全扫描
多Agent通信产品内群聊与协调公开A2A协议,跨框架/跨机器
安全责任更多集中在托管产品更多由操作员配置
成本结构捆绑在200美元/月Cursor Ultra等软件免费,基础设施与推理自选

两边都在优化“AI队友”的不同定义。

Grok Bot在做产品赌注:给Agent一台持久电脑,连上用户工作环境,保持可用,并尽量藏起基础设施。
Hermes在做运行时赌注:让操作员选择模型、执行环境、状态边界、工具、技能,甚至越来越多地选择Agent通信协议。

更简单地说:Grok Bot试图去掉操作摩擦;Hermes试图去掉架构锁定。

想派真实工作、又不想自己运营Agent栈的人,Grok Bot的路径可能正好对。
想组合Agent、换模型、检查状态、控制能力、并跨开放边界连接Agent的人,Hermes会有趣得多。

市场最终不必只选一种哲学。界面可能继续收敛,两边都看起来像一排等待派活的AI队友。可名单不是架构。当这些Agent开始持有凭证、控制电脑、积累技能、委托权限并把任务发给其他Agent时,界面底下坐着什么,才会成为产品最重要的部分。

你现在更在意去掉操作摩擦,还是去掉架构锁定?如果已经同时试过两边,哪一层的差异真正影响了你的日常工作流?

我是紫微AI,在做一个「人格操作系统(ZPF)」。后面会持续分享AI Agent和系统实验。感兴趣可以关注,我们下期见。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/22 2:09:56

如何快速导出微信聊天记录:WeChatMsg 完整指南

如何快速导出微信聊天记录:WeChatMsg 完整指南 【免费下载链接】WeChatMsg 提取微信聊天记录,将其导出成HTML、Word、CSV文档永久保存,对聊天记录进行分析生成年度聊天报告 项目地址: https://gitcode.com/GitHub_Trending/we/WeChatMsg …

作者头像 李华
网站建设 2026/8/22 2:09:23

LangGraph实战:构建本地多智能体代码生成与审查系统

LangGraph 是 LangChain 生态中用于构建复杂、有状态多智能体应用的核心框架。它不是一个独立的模型,而是一个编排工具,让你能用“图”的思维来设计和运行由多个 AI 智能体(Agent)和工具(Tool)协同工作的系…

作者头像 李华
网站建设 2026/8/22 2:08:41

美赛72小时决胜关键:建模思维与零故障工具链预演

1. 美赛前两周,我为什么把90%时间花在“不写代码”的准备上?美赛(MCM/ICM)不是比谁代码跑得快,而是比谁能在72小时内,把一个模糊、开放、跨学科的真实问题,拆解成可建模、可验证、可讲清楚的完整…

作者头像 李华
网站建设 2026/8/22 2:08:05

EDITBRIDGE:突破高分辨率图像AI编辑的显存与保真度瓶颈

1. 先搞清楚“高分辨率图像编辑”到底难在哪当你拿到一张4K、8K甚至更高分辨率的图片,想用AI模型给它换个背景、换个风格,或者局部修改一个细节时,大概率会遇到两个问题:要么模型直接报错“显存不足”,要么生成的结果在…

作者头像 李华
网站建设 2026/8/22 2:07:19

10分钟看懂黑盒日志:用PIDtoolbox把PID调参问题摊在屏幕上

10分钟看懂黑盒日志:用PIDtoolbox把PID调参问题摊在屏幕上 【免费下载链接】PIDtoolbox PIDtoolbox is a set of graphical tools for analyzing blackbox log data 项目地址: https://gitcode.com/gh_mirrors/pi/PIDtoolbox 穿越机抖了一路回来,…

作者头像 李华
网站建设 2026/8/22 2:05:57

学术生产力提升的实用路径与高效方法探究

链接链接很多时候,你和同门在效率与视野上的差距,并非源于智力或努力,而在于信息获取与处理的“工具差”。当别人还在用传统方式大海捞针时,有人已经用新工具建好了知识雷达。尤其在查找和消化国外文献这个核心环节,工…

作者头像 李华