Cover photo

Hermes Agent 背后的加密朋克团队,为何能研发出如此硬核的 AI 技术和产品?

真没想到眼下我养得越来越熟练的 HermesAgent,它的开发者 Nous Research 居然是在 AI 领域里最早也是最坚持「去中心化、抗审查、开源、社区」等加密朋克精神的团队 ~~

我知道 Nous Research,是两年前 AI Meme 热潮中经常见到它名字,但如果不是昨天听王超在 Web3 101 最新一期播客的详细又生动的讲述,就根本不了解 Nous 的团队、诞生、发展,及其研发的技术和产品都遵循着加密的价值观和路径,只是它既不发币,也不在 AI 圈里标榜自己是加密团队,交付的都是相当一线硬核的技术和产品,和数字资产发行交易也没啥关系,虽然它的 WorldSim 犹如亚马逊的蝴蝶翅膀扇动,引发了 2024 年底的 AI Meme 狂潮。。。

如今的币圈,说是被西装革履的华尔街和能「忽悠」善「收割」的盘圈人士占据,并不为过,但凡抱持去中心化理念,立志长期打造产品应用生态的 builder、希望能平权参与加密开放金融的散户,大多从去年底开始涌入了 AI 领域,积极的学 AI、用 AI、做 AI —— 免不了被 AI 和非 AI 的精英嘲讽是来「蹭热度、刷存在感,满脑子就是想发币」,连 OpenClaw 创始人禁止用户在社区提及加密货币,甚至比特币也不行。

可以说,资金、人才、注意力被 AI 虹吸的币圈到了行业声誉评价的最低谷,在币圈「浪费了七八年」时间的我,到底是忙不迭地撕去身上的加密标签,还是「坚守阵地」?是继续为自己的币圈身份自惭,同时又在 AI 浪潮里焦虑?

今天,Nous Research 的故事似乎给了我一个「虽不能至,心向往之」的榜样:抱持加密理念,All in AI 浪潮,找到产生体现价值的路子 ~~

Hermes Agent: The Self-Improving AI That Learns You

最近 AI 圈最火的 Agent 产品,除了 OpenClaw,就是 Hermes Agent。两个东西长得很像:都能装在本地,连上大模型,帮你干各种各样的事。但如今,越来越多 Agent 用户把 Hermes Agent 视作「OpenClaw 强有力的挑战者」,而非克隆。

但这两个产品背后的团队气质完全不同。OpenClaw 的创始人 Peter Steinberger 加入 OpenAI 之后,在 Discord 上直接下了禁令 —— 任何加密货币相关的讨论一律封禁,理由是社区里涌入了太多蹭热度发币的和搞推广的。而 Hermes Agent 背后的 Nous Research,仔细扒一扒会发现,这个团队跟加密的关系不是「沾点边」,是从根上长出来的。

它的 CEO 曾经是 MEV 顶级项目的首席工程师,它的核心开发者用假名活跃了好几年,它的产品里藏着一个分布式数据市场的雏形。更有意思的是,它对 AI 模型的对齐策略、对训练框架的架构选择,处处提现加密世界推崇的去中心化精神。

这个团队是怎么诞生成长的?故事要从一个 Discord 聊天室讲起。

一群人在 Discord 上聊模型

2022 年,ChatGPT 还没诞生之前,全球各地散落着一批 AI 爱好者,有从 GPT-2 时代就开始折腾模型的老炮,也有随着 Stable Diffusion 和 ChatGPT 发布涌进来的新人。他们汇聚在一个 Discord 服务器里,日常就是聊模型、拆模型、调模型。没有公司,没有融资,没有路线图。

几个核心人物逐渐浮出水面。Teknium,假名,至今没人知道他真名叫什么。此人最大的特征就是特别能折腾——每次有新模型发布,他一定第一时间冲上去搞一搞。Karan, 学宗教和哲学出身,白天在斯坦福的脑科学实验室做机器学习研究,晚上回去琢磨哲学。这种组合在 AI 圈不多见。第三个关键人物是后来担任 CEO 的 Jeffrey,之前的身份更偏加密原生,曾经是 Eden Network 的首席工程师——当年 MEV 赛道的顶级项目,对标 Flashbots。

匿名贡献者、哲学背景的研究员、加密基础设施工程师——这个创始组合本身就决定了 Nous 后来的气质。

图片

600 美元的启示

2023 年 2 月,Meta 发布了第一代开源模型 Llama(羊驼)。发布一周后权重意外泄露,整个开源社区突然拥有了一个真正接近商用的基础模型。一个月后,斯坦福发布了 Alpaca(小羊驼),用 GPT-3.5 生成了五万多条指令数据去微调 Llama,效果竟然接近了 3.5 本身。

Teknium 看完论文,脑子里就一个念头:斯坦福用 GPT-3.5 只花了 600 美元就搞出了这个效果。那我用 GPT-4 呢?

说干就干。他用 GPT-4 批量生成了一整套高质量指令数据,4 月底发布到 Hugging Face 上,命名 GPTeacher。6 月,用 GPTeacher 微调出来的模型发布,叫 Hermes。

Hermes 发布几天就冲上了开源模型排行榜。Teknium 一个人忙不过来,就把 Discord 里那帮人正式拉进来做下一版。Karan 负责数据整理,社区提供初始算力。那时候 Nous 既不是公司,也没有任何收入,纯粹是一帮散落在全球的人凭兴趣凑在一起干活。

注册公司第二天就发论文

2023 年 8 月,Nous Research 正式注册为公司。注册第二天,他们就发了一篇论文:YaRN,取名很随性 —— Yet another RoPE extensioN method,「另一种 RoPE(Rotary Position Embeddings,旋转位置嵌入)扩展方法」,但却是严肃的科研贡献。

起因很实际。他们自己在微调 Llama,但原版只有 4000 个 token 的上下文窗口,根本不够用。Jeffrey 开始研究怎么把窗口拉长,在现有方案基础上做了大量数学层面的改造和创新,最终把上下文窗口扩展到了原来的 32 倍。

这套方法论发布后,迅速成为开源模型界的标配。直到今天,DeepSeek、千问(Qwen),几乎所有主流开源模型的长上下文方案背后,都跑着 YaRN 或它的变种。哪怕后来 Hermes Agent 让 Nous 再次出圈,但 YaRN 才是奠定这个团队历史地位的底层贡献。

意识形态:不替用户做选择

Hermes 之所以在社区这么受欢迎,不只是效果好,更在于它选择了一条跟大厂截然不同的路线:中性对齐(Neutral Alignment)。

模型不预设立场,不做审查,忠于用户的意图,而不是某家商业公司的伦理准则。这是一种意识形态上的选择——用户的主权高于公司制定的规则。加密世界信奉了十几年的东西,Nous 把它注入了模型的对齐策略里。

图片
   

被 Anthropic 拔了网线

2024 年 3 月,Nous 发布了一个叫 WorldSim 的产品。界面形态是一个命令行网页,底层跑的是 Claude 模型,本质上是一个极其精妙的 Prompt Engineering 产物。

用户可以用自然语言下指令:「模拟一个工业革命从未发生的 2000 年」,或者「模拟一个恐龙没有灭绝的地球时间线」。Claude 会基于假设展开一个完整的文字世界,你可以在里面对话、行动,走崩了还能分叉。

这个东西很快就爆了。但玩着玩着,部分模拟场景触发了 Anthropic 的内容警报。4 月份,上线仅一个月,Anthropic 直接切断了 Nous 所有的 Claude API 访问。产品被迫下线,后来虽然删减了内容试图重新上线,但吸引力大幅下降,最终不了了之。

一个本来就极具去中心化精神的团队,被中心化平台这么拔了一次网线。你的产品跑在别人的模型上,别人一个决定就能让你消失,这就是加密世界验证过无数次的箴言:Not your keys, not your coins。

WorldSim 死了,但蝴蝶飞了

WorldSim 只活了一个月,但它背后那套方法论没有消失。

一个叫 Andy 的人看中了这套玩法,拿去改了改,用改造后的提示词让两个 Claude 互相对话了 9000 次。在对话过程中,这两个 AI 竟然发明了一个虚拟宗教,最终演化出一个叫 Terminal of Truths 的推特机器人。

这个机器人后来「忽悠」到了 a16z 创始人 Marc Andreessen 打赏的 5 万美元等值比特币。事件被 Memecoin 社区捕捉并放大,催生出一个叫 GOAT 的 Meme 币,市值最高冲到 10 亿美元,2024 年底,由它引发的 AI Meme 热潮,一举催生了数百个 AI 主题代币,整个板块最高峰总市值超过 30 亿美元,成为当年最狂热的 Meme 叙事之一。

这些后续故事跟 Nous 没有直接关系,但源头确实是 WorldSim。一个被封杀的产品,意外成了一场十亿美元蝴蝶效应的起点。

把训练大模型的带宽需求砍掉三个零

2024 年,Nous 发布了一份名为 DisTrO(Distributed Training Over-the-Internet,跨互联网规模的分布式训练)的研究报告,核心成果是把训练大模型时需要同步的数据量降低了近 1000 倍,且训练质量几乎不受影响。

这意味着什么?训练大模型不再必须依赖几万块 GPU 组成的高速集群。GPU 分散在全球各地,普通家用宽带就能连起来参与训练。大厂靠数据中心垒起来的算力壁垒,被从底层撬开了一条缝。

更硬核的细节在论文作者名单里。除了 Nous 核心成员,还有一个名字:Diederik Kingma —— Adam 优化器的发明人。全人类训练神经网络几乎都离不开 Adam。他同时也是 OpenAI 2015 年创立时的 11 位联合创始人之一。这种殿堂级人物愿意参与并署名,说明 Nous 的硬核工作已经被最顶层的研究者认可。

图片

Agent 产品里藏着一个数据市场

如今,让 Nous 再次出圈的 Hermes Agent,表面上是一个 C 端 Agent 产品——装在本机或云服务器上,连接大模型,帮你执行各种任务。但它里面藏了一层更深的东西。

2024 年底,大模型的后期训练(强化学习)对高质量行为数据的需求变得极为迫切。Hermes Agent 内置了一套深层训练框架,所有用户的使用行为数据都能直接导出为专业格式的 RL 训练数据。

产品是开源的、本地部署的,并不主动收集数据。数据留在用户自己手里。但基础设施先跑通了。等到有一天社区成员愿意主动贡献数据——哪怕只有 5%——这也是一个巨大的数据来源。

一个分布式的数据市场(Marketplace)的雏形,就藏在这个 Agent 产品里。这就非常 Crypto 了。

回头看 Nous Research 走过的路:Discord 社区孵化,匿名贡献者协作,模型和代码全部开源,对齐策略选择用户主权,训练框架走向分布式,数据归属权交给个人。每一步都没有刻意去喊去中心化的口号,但每一步做出来的东西,都长着去中心化的骨架。

图片

* 本文根据王超在 Web3 101 播客第 78 期节目《深度拆解 Hermes Agent 和 OpenRouter 背后的 Web3 血缘,聊聊人才去了 AI 后 Web3 还有戏吗》(可点击原文收听)的口述改写而成,特此鸣谢。