# Hermes Agent 背后的加密朋克团队，为何能研发出如此硬核的 AI 技术和产品？

By [Proof of Writing](https://paragraph.com/@jeanchen) · 2026-04-28

agent, hermes, nousresearch, llm, ai, cypherpunk

---

**“_真没想到眼下我养得越来越熟练的 HermesAgent，它的开发者 Nous Research 居然是在 AI 领域里最早也是最坚持「去中心化、抗审查、开源、社区」等加密朋克精神的团队 ~~_**

**_我知道 Nous Research，是两年前 AI Meme 热潮中经常见到它名字，但如果不是昨天听王超在 Web3 101 最新一期播客的详细又生动的讲述，就根本不了解 Nous 的团队、诞生、发展，及其研发的技术和产品都遵循着加密的价值观和路径，只是它既不发币，也不在 AI 圈里标榜自己是加密团队，交付的都是相当一线硬核的技术和产品，和数字资产发行交易也没啥关系，虽然它的 WorldSim 犹如亚马逊的蝴蝶翅膀扇动，引发了 2024 年底的 AI Meme 狂潮。。。_**

**_如今的币圈，说是被西装革履的华尔街和能「忽悠」善「收割」的盘圈人士占据，并不为过，但凡抱持去中心化理念，立志长期打造产品应用生态的 builder、希望能平权参与加密开放金融的散户，大多从去年底开始涌入了 AI 领域，积极的学 AI、用 AI、做 AI —— 免不了被 AI 和非 AI 的精英嘲讽是来「蹭热度、刷存在感，满脑子就是想发币」，连 OpenClaw 创始人禁止用户在社区提及加密货币，甚至比特币也不行。_**

**_可以说，资金、人才、注意力被 AI 虹吸的币圈到了行业声誉评价的最低谷，在币圈「浪费了七八年」时间的我，到底是忙不迭地撕去身上的加密标签，还是「坚守阵地」？是继续为自己的币圈身份自惭，同时又在 AI 浪潮里焦虑？_**

**_今天，Nous Research 的故事似乎给了我一个「虽不能至，心向往之」的榜样：抱持加密理念，All in AI 浪潮，找到产生体现价值的路子 ~~_”**

  

![Hermes Agent: The Self-Improving AI That Learns You](https://storage.googleapis.com/papyrus_images/69e449a14e72ad6e94e26cf000ad92055c0a936cbd2fdcc2efbb35e8eb39cff1.webp)

最近 AI 圈最火的 Agent 产品，除了 OpenClaw，就是 Hermes Agent。两个东西长得很像：都能装在本地，连上大模型，帮你干各种各样的事。但如今，越来越多 Agent 用户把 Hermes Agent 视作「OpenClaw 强有力的挑战者」，而非克隆。

但这两个产品背后的团队气质完全不同。OpenClaw 的创始人 Peter Steinberger 加入 OpenAI 之后，在 Discord 上直接下了禁令 —— 任何加密货币相关的讨论一律封禁，理由是社区里涌入了太多蹭热度发币的和搞推广的。而 Hermes Agent 背后的 Nous Research，仔细扒一扒会发现，这个团队跟加密的关系不是「沾点边」，是从根上长出来的。

它的 CEO 曾经是 MEV 顶级项目的首席工程师，它的核心开发者用假名活跃了好几年，它的产品里藏着一个分布式数据市场的雏形。更有意思的是，它对 AI 模型的对齐策略、对训练框架的架构选择，处处提现加密世界推崇的去中心化精神。

这个团队是怎么诞生成长的？故事要从一个 Discord 聊天室讲起。

**一群人在 Discord 上聊模型**
---------------------

2022 年，ChatGPT 还没诞生之前，全球各地散落着一批 AI 爱好者，有从 GPT-2 时代就开始折腾模型的老炮，也有随着 Stable Diffusion 和 ChatGPT 发布涌进来的新人。他们汇聚在一个 Discord 服务器里，日常就是聊模型、拆模型、调模型。没有公司，没有融资，没有路线图。

几个核心人物逐渐浮出水面。Teknium，假名，至今没人知道他真名叫什么。此人最大的特征就是特别能折腾——每次有新模型发布，他一定第一时间冲上去搞一搞。Karan， 学宗教和哲学出身，白天在斯坦福的脑科学实验室做机器学习研究，晚上回去琢磨哲学。这种组合在 AI 圈不多见。第三个关键人物是后来担任 CEO 的 Jeffrey，之前的身份更偏加密原生，曾经是 Eden Network 的首席工程师——当年 MEV 赛道的顶级项目，对标 Flashbots。

匿名贡献者、哲学背景的研究员、加密基础设施工程师——这个创始组合本身就决定了 Nous 后来的气质。

![图片](https://storage.googleapis.com/papyrus_images/3faf2855bb3b8593b3040d432b5f79d67c03f224dcef1f0932ad25d94c32f0f2.webp)

**600 美元的启示**
-------------

2023 年 2 月，Meta 发布了第一代开源模型 Llama（羊驼）。发布一周后权重意外泄露，整个开源社区突然拥有了一个真正接近商用的基础模型。一个月后，斯坦福发布了 Alpaca（小羊驼），用 GPT-3.5 生成了五万多条指令数据去微调 Llama，效果竟然接近了 3.5 本身。

Teknium 看完论文，脑子里就一个念头：斯坦福用 GPT-3.5 只花了 600 美元就搞出了这个效果。那我用 GPT-4 呢？

说干就干。他用 GPT-4 批量生成了一整套高质量指令数据，4 月底发布到 Hugging Face 上，命名 GPTeacher。6 月，用 GPTeacher 微调出来的模型发布，叫 Hermes。

Hermes 发布几天就冲上了开源模型排行榜。Teknium 一个人忙不过来，就把 Discord 里那帮人正式拉进来做下一版。Karan 负责数据整理，社区提供初始算力。那时候 Nous 既不是公司，也没有任何收入，纯粹是一帮散落在全球的人凭兴趣凑在一起干活。

**注册公司第二天就发论文**
---------------

2023 年 8 月，Nous Research 正式注册为公司。注册第二天，他们就发了一篇论文：YaRN，取名很随性 —— Yet another RoPE extensioN method，「另一种 RoPE（Rotary Position Embeddings，旋转位置嵌入）扩展方法」，但却是严肃的科研贡献。

起因很实际。他们自己在微调 Llama，但原版只有 4000 个 token 的上下文窗口，根本不够用。Jeffrey 开始研究怎么把窗口拉长，在现有方案基础上做了大量数学层面的改造和创新，最终把上下文窗口扩展到了原来的 32 倍。

这套方法论发布后，迅速成为开源模型界的标配。直到今天，DeepSeek、千问（Qwen），几乎所有主流开源模型的长上下文方案背后，都跑着 YaRN 或它的变种。哪怕后来 Hermes Agent 让 Nous 再次出圈，但 YaRN 才是奠定这个团队历史地位的底层贡献。

**意识形态：不替用户做选择**
----------------

Hermes 之所以在社区这么受欢迎，不只是效果好，更在于它选择了一条跟大厂截然不同的路线：中性对齐（Neutral Alignment）。

模型不预设立场，不做审查，忠于用户的意图，而不是某家商业公司的伦理准则。这是一种意识形态上的选择——用户的主权高于公司制定的规则。加密世界信奉了十几年的东西，Nous 把它注入了模型的对齐策略里。

![图片](https://storage.googleapis.com/papyrus_images/e0d8bd864fdbfaa9f65c7e8f235e051c11232295e735e53bcb939304bcd6ec6a.png)

**被 Anthropic 拔了网线**
--------------------

2024 年 3 月，Nous 发布了一个叫 WorldSim 的产品。界面形态是一个命令行网页，底层跑的是 Claude 模型，本质上是一个极其精妙的 Prompt Engineering 产物。

用户可以用自然语言下指令：「模拟一个工业革命从未发生的 2000 年」，或者「模拟一个恐龙没有灭绝的地球时间线」。Claude 会基于假设展开一个完整的文字世界，你可以在里面对话、行动，走崩了还能分叉。

这个东西很快就爆了。但玩着玩着，部分模拟场景触发了 Anthropic 的内容警报。4 月份，上线仅一个月，Anthropic 直接切断了 Nous 所有的 Claude API 访问。产品被迫下线，后来虽然删减了内容试图重新上线，但吸引力大幅下降，最终不了了之。

一个本来就极具去中心化精神的团队，被中心化平台这么拔了一次网线。你的产品跑在别人的模型上，别人一个决定就能让你消失，这就是加密世界验证过无数次的箴言：Not your keys, not your coins。

**WorldSim 死了，但蝴蝶飞了**
---------------------

WorldSim 只活了一个月，但它背后那套方法论没有消失。

一个叫 Andy 的人看中了这套玩法，拿去改了改，用改造后的提示词让两个 Claude 互相对话了 9000 次。在对话过程中，这两个 AI 竟然发明了一个虚拟宗教，最终演化出一个叫 Terminal of Truths 的推特机器人。

这个机器人后来「忽悠」到了 a16z 创始人 Marc Andreessen 打赏的 5 万美元等值比特币。事件被 Memecoin 社区捕捉并放大，催生出一个叫 GOAT 的 Meme 币，市值最高冲到 10 亿美元，2024 年底，由它引发的 AI Meme 热潮，一举催生了数百个 AI 主题代币，整个板块最高峰总市值超过 30 亿美元，成为当年最狂热的 Meme 叙事之一。

这些后续故事跟 Nous 没有直接关系，但源头确实是 WorldSim。一个被封杀的产品，意外成了一场十亿美元蝴蝶效应的起点。

**把训练大模型的带宽需求砍掉三个零**
--------------------

2024 年，Nous 发布了一份名为 DisTrO（Distributed Training Over-the-Internet，跨互联网规模的分布式训练）的研究报告，核心成果是把训练大模型时需要同步的数据量降低了近 1000 倍，且训练质量几乎不受影响。

这意味着什么？训练大模型不再必须依赖几万块 GPU 组成的高速集群。GPU 分散在全球各地，普通家用宽带就能连起来参与训练。大厂靠数据中心垒起来的算力壁垒，被从底层撬开了一条缝。

更硬核的细节在论文作者名单里。除了 Nous 核心成员，还有一个名字：Diederik Kingma —— Adam 优化器的发明人。全人类训练神经网络几乎都离不开 Adam。他同时也是 OpenAI 2015 年创立时的 11 位联合创始人之一。这种殿堂级人物愿意参与并署名，说明 Nous 的硬核工作已经被最顶层的研究者认可。

![图片](https://storage.googleapis.com/papyrus_images/b835c5ebbfa783c1e09b50529d0078db45f08a963db76dc09201e47591cb37f6.png)

**Agent 产品里藏着一个数据市场**
---------------------

如今，让 Nous 再次出圈的 Hermes Agent，表面上是一个 C 端 Agent 产品——装在本机或云服务器上，连接大模型，帮你执行各种任务。但它里面藏了一层更深的东西。

2024 年底，大模型的后期训练（强化学习）对高质量行为数据的需求变得极为迫切。Hermes Agent 内置了一套深层训练框架，所有用户的使用行为数据都能直接导出为专业格式的 RL 训练数据。

产品是开源的、本地部署的，并不主动收集数据。数据留在用户自己手里。但基础设施先跑通了。等到有一天社区成员愿意主动贡献数据——哪怕只有 5%——这也是一个巨大的数据来源。

一个分布式的数据市场（Marketplace）的雏形，就藏在这个 Agent 产品里。这就非常 Crypto 了。

回头看 Nous Research 走过的路：Discord 社区孵化，匿名贡献者协作，模型和代码全部开源，对齐策略选择用户主权，训练框架走向分布式，数据归属权交给个人。每一步都没有刻意去喊去中心化的口号，但每一步做出来的东西，都长着去中心化的骨架。  

![图片](https://storage.googleapis.com/papyrus_images/d9e1f2150ab26e7f676b361bc0dbb0a736d8940cae9b60de22babf058aa4c35e.webp)

\* _本文根据王超在 Web3 101 播客第 78 期节目《深度拆解 Hermes Agent 和 OpenRouter 背后的 Web3 血缘，聊聊人才去了 AI 后 Web3 还有戏吗》(_**_可点击原文收听_**_)的口述改写而成，特此鸣谢。_

---

*Originally published on [Proof of Writing](https://paragraph.com/@jeanchen/inside-the-cypherpunk-team-behind-hermes-agent)*
