前沿AI群7449条实战经验总结:从0到1拿捏Hermes Agent

本文档从7449条群聊记录里扒出来的,覆盖Hermes Agent的前世今生。面向零基础小白,看完你也可以是那个懂AI的人。

2026年了,AI大模型已经强到能写代码、能做视频、能帮你赚钱——但绝大多数人还在把它当百度用。问个问题,复制粘贴答案,然后该干嘛干嘛。

聊天框里的GPT就像一个被困在笼子里的猛兽。它空有一身本事,但你没有给它"手"和"脚",它只能陪你聊天。而AI Agent做的事情,就是把笼子打开——让AI能读你的文件、操控你的浏览器、定时执行任务、自己给自己排工作计划。

说白了,这是从"你伺候AI"到"AI伺候你"。

这篇文章里有什么?

这不是那种"AI将改变世界"的泛泛而谈。这里面的每一个知识点,都是从7449条真实的群聊记录里扒出来的——群里有程序员、运营、创业者、内容创作者,大家每天在群里交流怎么用AI赚钱、踩坑经验分享、怎么省钱、怎么用AI提效。

16个章节,全是干货:

这本教程将带你从零开始,一步步走进 AI Agent 的世界。我们会讲清楚:Agent 是什么、怎么装、怎么调教、怎么让它变成你的私人助理。无论你是想提高工作效率、做内容创作,还是寻找商业机会,这里都有你需要的知识。

一、什么是AI Agent?先理解底层概念

1.1 AI Agent不是聊天机器人

很多人以为AI Agent就是一个能聊天的机器人。这是天大的误会。

聊天机器人:你问一句,它答一句。没有自主行动能力,记忆有限,每次对话都是"重新开始"。

AI Agent:一个拥有"手"和"脑"的AI。它不仅能和你对话,还能:

– 操作你的文件系统(读、写、删除、创建)

– 执行终端命令(安装软件、配置环境、运行脚本)

– 访问网络(抓取数据、调用API、控制浏览器)

– 自我进化(根据你的使用习惯调整自己的行为)

– 定时执行任务(你不说话它也能干活)

用群聊里的一个经典比喻来理解:AI Agent就像一个实习生——它有很强的专业知识,但缺乏主动性。你需要告诉它做什么,偶尔骂它两句(真的有用),它就会越干越好。

1.2 Agent的核心三要素

说白了,任何一个AI Agent就三样东西:

1. 大模型(大脑):决定Agent聪不聪明。GPT、Claude、DeepSeek,丰俭由人。

2. 工具/技能(双手):就是Skill和MCP。没工具的Agent就像没打火机的原始人——只能钻木取火,累个半死还没点着。有了工具,咔嚓一下,火来了。

3. 记忆系统(经验):Agent记住你是谁、你喜欢啥、你做过什么。好的记忆系统让Agent越用越懂你,差的记忆系统让你每次都得从头解释"我是谁我在哪我要干嘛"。

1.3 为什么Hermes Agent是这个时代的"宝刀"?

Hermes Agent(中文俗称"爱马仕")是Nous Research开发的开源AI Agent框架。群聊里反复验证过的结论:目前最好用的Agent,没有之一。

之前流行过的OpenClaw(外号"小龙虾"),已经被Hermes全面碾压。核心差距在哪?

– 自主学习进化:用得越久越好用,会自己写记忆文件。小龙虾呢?用久了还是那只龙虾。

– 丰富的内置Skill:装好就能用,不需要从零造轮子

– 多Agent原生支持:可以搞一个Agent军团,分工协作

– 通讯软件接入:Telegram、飞书、微信、QQ都能接,走到哪AI跟到哪

– 活跃的社区:几乎每天都有更新,bug不过夜

二、Hermes Agent(爱马仕)全方位指南

2.1 Hermes究竟是什么?

Hermes Agent是一个开源的AI智能体框架。注意:它自己不带AI能力——AI能力来自你接入的大模型(GPT、DeepSeek等)。

你可以把Hermes理解成智能版的N8N,但爽得多:

– N8N:手动搭工作流、配节点、写代码,累死累活

– Hermes:你张张嘴,它自己搞定一切。真的就是张嘴——对AI说句话就行

2.2 Hermes能做什么?

基于群聊中大量真实使用场景:

场景

具体功能

**内容创作**

自动找爆款→改写文案→AI生图→拼视频→发布草稿

**数据抓取**

抓抖音爆款视频、抓公众号文章、抓小红书笔记

**知识管理**

自动整理知识库到Obsidian、飞书、Notion

**代码开发**

写网页、写小程序、写脚本、自动部署上线

**微信聊天分析**

提取微信聊天记录、生成群聊日报、分析需求信号

**日常助理**

定时推送、监控竞品、自动回复、数据报表

**破解/逆向**

破解软件VIP、分析二进制文件(需本地部署)

2.3 Hermes vs 小龙虾(OpenClaw) vs Claude Code vs Codex

群聊中大量讨论了这几个工具的对比:

特性

Hermes

小龙虾(OpenClaw)

Claude Code

Codex

**上手难度**

中等

较高

较低

**自主学习**

⭐⭐⭐⭐⭐

⭐⭐

⭐⭐⭐

**稳定性**

⭐⭐⭐⭐

**多Agent**

**通讯接入**

极强(多平台)

较强

无

**编程能力**

**适用场景**

全能型

多任务调度

编程专精

文件/界面操作

一句话总结:

– 做编程为主的精细工作用Claude Code

– 做需要操作本地文件/浏览器的用Codex

– 做全自动化的综合业务用Hermes

– 小龙虾是过去式,已经被Hermes全面超越

2.4 Hermes桌面端

2026年5月底,官方终于推出了Hermes Agent桌面端。

下载地址:https://hermes-agent.nousresearch.com/desktop

安装要点(来自群聊踩坑经验):

– 官方安装包目前兼容性一般,很多文件需要在安装时联网下载

– 网络环境差容易卡住或失败

– 建议开TUN模式安装,否则大概率失败

– 如果实在装不上,可以让Codex帮你装

– 桌面端的本质还是命令行,只是加了可视化界面

– 可以用Codex给桌面端做汉化——不是无脑翻译,该保留英文的地方保持不变

2.5 云端部署 vs 本地部署

群聊里被问得最多的问题。答案很简单,但很多人就是想不明白。

云端服务器部署(闭眼选这个):

– ✅ 24小时在线,电脑关了AI还在吭哧吭哧干活

– ✅ 天然在外网,不用折腾什么"魔法"

– ✅ 换设备随便连(手机、平板、任何电脑)

– ✅ 不会误删你本地电脑里的文件(别问我为什么知道,都是泪)

– ❌ 没法直接操控本地电脑的软件界面

– ❌ 服务器要花钱(每月二三十到三四十,一杯奶茶钱)

本地电脑部署(能不用就不用):

– ✅ 可以直接操作本地文件和软件

– ✅ 不用服务器月费

– ✅ 能读微信聊天记录(靠本地Key)

– ❌ 电脑关了AI就歇了

– ❌ Windows适配差到令人发指(建议用Mac或Linux)

– ❌ 新手操作容易误删本地文件……是的,又是泪

– ❌ 得一直保持网络通畅

结论:云端Hermes + 本地Hermes,黄金搭档。云端负责24小时自动化,本地Hermes负责需要操作本地文件的脏活(比如提取微信聊天记录)。

2.6 Hermes的安装方法

安装爱马仕Hermes优先看这个,图文教程更详细:

Hermes保姆级教程生财版:https://scys.com/articleDetail/xq_topic/45544851255144218

Hermes保姆级教程飞书版:从0到1部署你的AI智能体:Hermes Agent 保姆级图文教程,让爱马仕替你打工

是同一篇文章 只是前者是 生财有术平台 后者是 飞书文档 。

这个教程一共讲了两种安装方式分别是:

方法一:命令行直接安装(菜鸟教程方式)⭐推荐

参考菜鸟教程。

适合有一定命令行基础的用户

优点:最纯净、最灵活、升级方便

真实经验:这种方式安装的Hermes最稳定,升级也最方便。缺点是需要一些命令行基础。

方法二:1Panel面板安装

– 适合小白,一键安装

– 缺点:升级困难,容易版本跟不上

– 群聊中多人反映:1Panel里的"升级按钮"点了看起来升级了,但实际上还是旧版本

– 1Panel的Hermes是Docker部署,权限受限,功能不全

– 出现问题后难以排查和修复

⚠️ **2026年6月3-4日翻车事件**:多位群友用1Panel升级后Hermes直接崩溃。原因是升级过程污染了 `.env` 文件,容器找不到系统命令。最终花了40分钟、烧了70K token才修好。详细排查步骤见[第十五章 15.2节](#15)。**建议新手尽量用命令行安装,出问题至少知道从哪里排查。**

2.7 Hermes升级与版本管理

升级命令:

hermes update

注意:这个命令要在终端执行,不是在和AI的对话里发。

查看版本:

hermes –version

升级注意事项(来自血泪教训):

– Hermes的迭代速度极快,几天不升级就可能遇到兼容性问题

– 升级后可能需要重新配置模型

– GPT Plus会员通过OAuth登录时,如果版本太旧会报错——升级到最新即可解决

– 升级后一定要验证版本号,AI有时候会"骗你"说升级好了,实际没升级

– 升级出了问题,新开一个终端对话让AI给你修

2.8 Gateway(网关)

Gateway是Hermes的核心组件,负责消息的接收和转发。

重启Gateway:

hermes gateway restart

⚠️ 注意:这个命令要在终端执行,不要在对话里执行。如果在对话里执行,会把Gateway杀掉,对话自然就断了。

Gateway常见问题:

– 换模型后Gateway可能不响应——重启Gateway即可

– Gateway没有常驻运行会导致机器人"失联"

– 如果卡死,可以先用`kill`杀掉Gateway进程,再重新启动

三、AI大模型的选择与使用

3.1 模型排行榜(群聊实测总结)

国外御三家(天花板级别)

排名

模型

特点

价格

1

Claude

写作文案天花板,逻辑最强

较贵(Pro $200/月)

2

GPT-5.4/5.5

综合能力最强,Agent表现极佳

Plus约70元/月

3

Gemini 3.1/3.5

多模态强,有免费额度

有免费版

国产御三家(能用级别)

DeepSeek V4 Pro

国产最强,排名29,综合86.2

按量计费

GLM-5/5.1

代码能力强,但饥饿营销难抢

149元/月起

Kimi K2.6

综合可用,有包月套餐

199元/月

一句话总结模型选择:

– Claude是爹,GPT是二哥,Gemini是三弟

– 智谱给这三个爹擦皮鞋

– 豆包和DeepSeek是垫脚石(但DeepSeek V4 Pro出来后支棱起来了,国产最强没悬念)

– 有国外模型优先用国外的,国内模型做备胎——很残酷,但这是现实

3.2 模型接入Hermes的方式

方式一:API Key接入

去各模型平台申请API Key,然后在Hermes中配置。

# 在Hermes终端输入:

hermes model

# 然后按提示选择provider,填入API Key

各模型API路径参考:

– GLM(有套餐):`https://open.bigmodel.cn/api/anthropic`

– GLM(无套餐/余额):`https://open.bigmodel.cn/api/paas/v4`

– Kimi Coding Plan:`https://api.kimi.com/coding`

– 阿里百炼(有套餐):`https://coding.dashscope.aliyuncs.com/v1/chat/completions`

方式二:OAuth授权登录

这是个王炸级别的技巧——把网页版GPT Plus会员直接接入Hermes,不用单独买API!

– 选OpenAI provider → OAuth授权

– 浏览器打开授权链接 → 登录GPT → 复制回调URL里的code

– 粘贴回终端,搞定

这意味着什么? 一个70元/月的GPT Plus会员,同时在网页端、Codex、Hermes三个地方用。一鱼三吃,资本家看了都落泪。

方式三:OpenRouter聚合

适合初学者,充$10有每天1000次免费请求。支持DeepSeek V4、Claude Sonnet等多个模型。

主模型 + 备用模型配置(推荐配置):

# 配置文件示例

default: gpt-5.4

provider: openai-codex

base_url: https://chatgpt.com/backend-api/codex

fallback_providers:

– provider: kimi-coding

model: "Kimi K2.6"

base_url: "https://api.kimi.com/coding"

api_key: ""

这样当GPT额度用完后,自动切换到Kimi,不会中断工作。

3.3 各模型适配Hermes的经验

适配情况

注意事项

Plus会员OAuth最方便,额度耗尽自动切备用模型

需API或中转,Pro版不让接Hermes

Gemini

API有限速,免费额度很少

国产最强,但没有视觉模型(不能看图)

GLM-5.1

要抢套餐(每天10点),在海外服务器上会慢

有199元包月套餐,量大管饱,智商中等

Grok

OAuth授权不稳定

豆包

⭐

不适合生产环境,只能做简单任务

3.4 视觉模型(看图)问题

很多群友反馈Hermes不能识别图片。原因在于:

– DeepSeek V4 Pro没有视觉能力,所以用它做主力模型就看不了图

– 解决方案:接入一个有视觉的辅助模型

– 可以接Kimi(有视觉能力)

– 可以接千问的视觉模型

– 可以接豆包识图(虽然豆包很垃圾,但识别图片够用)

– 或者直接切换成GPT(GPT是原生多模态,能看图)

一句话:不是Hermes不能看图,是你请了个"瞎子"当主力模型。换个有眼睛的就行。

四、Skill(技能):AI的武器库

4.1 什么是Skill?

Skill是AI Agent的"打火机"。

用一个经典比喻来理解:你在野外想让AI给你生火。

– 没有Skill的AI:掏出一根木棍开始钻木取火,钻了十分钟磨磨蹭蹭还没成功,然后换个方法找打火石…

– 有Skill的AI:你直接把打火机(Skill)给它,啪!火点着了。

Skill本质上就是写好的代码和提示词,打包成AI可以直接使用的工具。有的Skill是代码、有的是复杂提示词、有的是MCP协议、有的是完整的自动化脚本。

4.2 必须安装的Skill

第一优先级:find-skills

这是元Skill——用来找其他Skill的Skill。

npx skills add https://github.com/vercel-labs/skills –skill find-skills

安装后,你只需要说"我需要一个做PPT的Skill"或"我需要抓小红书的Skill",AI会自动搜索并安装合适的Skill。

Skill搜索网站:

– https://skills.sh/

– https://skillsmp.com/

– https://clawhub.ai/skills

4.3 推荐的Skill清单

根据群聊推荐:

Skill

用途

find-skills

找Skill的Skill,必装

skill-create

创建自定义Skill

web-access

强大的联网访问能力,绕过反爬

wechat-daily

微信群聊日报分析

find-skills里的内容生成

自动写公众号文章、小红书笔记

小红书发布

自动发布小红书笔记

PPT生成

自动制作PPT

AI去味

去掉AI写作的机械感

占星/命理

玄学类自动化

4.4 如何创建自己的Skill

1. 让AI跑一遍你的业务流程

2. 对AI说"把这个流程封装成一个Skill"

3. AI会生成Skill的MD文件

4. 把文件放到Hermes的Skill目录即可

Skill是通用的:Claude Code和Hermes的Skill可以互相使用,因为它们都是MD文件格式。

五、安装部署后配置

5.1 Hermes的多Profile管理

一个Hermes可以创建多个Agent(智能体),每个Agent有独立的:

– 灵魂文件(Soul/Memory)

– 大模型配置

– 对话历史

– Skill配置

访问Hermes的Web面板可以直观管理所有Agent。面板地址一般是`http://<服务器IP>:9119`。

5.2 环境变量配置(.env文件)

Hermes的配置文件在`~/.hermes/.env`。

常见问题:大模型配置错了可以手动编辑这个文件,找到对应的Key删除或修改。

修改后需要重启Gateway让配置生效。

六、通讯软件接入:让AI随时随地为你服务

6.1 各通讯软件对比

通讯软件

适配程度

功能完整性

推荐度

**Telegram**

可发图片/视频/语音/文件

🥇首选

**飞书**

可以,但复杂任务有时超时

🥈备选

**微信**

适配最差,易封号

⚠️慎用

**Discord**

体验好但大陆用不了

Telegram为什么最佳:

– Hermes本身就是国外项目,最适配国外软件

– 可以发图片、视频、语音、文件

– 响应速度快,不会超时断开

– 可以创建多群组,不同群组配不同Agent

微信为什么不推荐:

– 适配最差,功能不完整

– 定时任务推送不了

– 语音适配不好

6.2 接入方法

飞书:一句话让Hermes自己配就行。把飞书开放平台的App ID和Secret发给它。

Telegram:

1. 在Telegram找@BotFather创建机器人

2. 获取Bot Token

3. 在Hermes中配置Bot Token

4. 一个Hermes可以配多个Bot,每个Bot独立工作

微信:

– 微信机器人的配置比较复杂,且仅支持私聊,不支持群聊

– 企业微信的机器人也只能在内部群使用

– 建议非必要不接入微信

6.3 通讯软件的本质

所有通讯软件(飞书、微信、Telegram)本质上都只是一个"显示器"——它们把服务器终端的信息转发到你的手机上。

真正的Agent协作、任务执行都在云端服务器上完成。你选择了什么通讯软件只是选择了不同的"显示器"而已。

七、多Agent协作:从单兵作战到军团作战

7.1 什么是多Agent协作

一个Hermes可以创建多个Agent,每个Agent:

– 有独立的灵魂文件(不同的性格和专长)

– 可以使用不同的大模型

– 可以专注于不同的任务

经典配置(以视频制作为例):

– Agent 1:爆款拆解员

– Agent 2:资料核查员

– Agent 3:文案写手

– Agent 4:字幕/分镜拆分员

– Agent 5:画面生成员

– Agent 6:音频制作员

– Agent 7:剪辑合成员

– Agent 8:终审员

这8个Agent协作完成一条视频,效率远超人类。

7.2 如何配置多Agent协作

1. 升级Hermes到最新版本

2. 创建多个Agent,给每个注入灵魂文件和身份信息

3. 使用看板(Dashboard)给每个Agent分配任务

4. Agent之间可以互相通信、传递数据

以上动作你直接对着你的爱马仕口喷即可。

另一种方式:在Telegram创建群组,把多个Bot拉进去。每个Bot是不同的Agent,可以在群里互相讨论、传递任务。

7.3 多Agent的调度

主Agent负责统一调度,分配任务给各个副Agent。主模型和副模型可以不同:

– 主模型用GPT(智商高,善规划)

– 副模型用Kimi/DeepSeek(便宜,做苦力活)

八、爬虫与数据抓取实战

8.1 爬取策略排名(安全性从高到低)

1. 模拟人工操作(最安全):用无头浏览器模拟人的行为,网站基本检测不到

2. 使用官方/第三方API(安全):有API就用API,结构化的数据最好处理

3. Skill/MCP(中等):基于协议的工具调用,比裸爬虫安全

4. 爬虫脚本(较高风险):容易被反爬机制检测

8.2 反爬突破技巧

核心工具:

– Camofox浏览器:AI反爬浏览器,可以绕过大部分网站的反爬机制

– web-access Skill:强大的联网访问能力

– 模拟浏览器自动化:用CDP协议控制浏览器,模拟真人操作

给Cookie:对于需要登录才能访问的平台(如Instagram),把Cookie发给AI,相当于让它以你的身份登录。

节奏控制:不是一秒发100个请求,而是像一个正常人的浏览速度。这样基本不会触发反爬。

8.3 各平台抓取经验

平台

难度

方法

抖音

有开源的解析工具,给链接就能提取文案和视频

公众号

有开源导出工具(wechat-article-exporter,1万+星)

小红书

用Camofox + 模拟浏览器,或使用MCP

Instagram

需要登录Cookie,建议用小号操作

飞书文档

低

Hermes直接能读取和导出

九、解密微信聊天记录:把脏活丢给爱马仕

9.1 微信把你的聊天记录锁起来了

先说个残酷的事实:你电脑里存了几十G的微信聊天记录,但你看不了。

微信把这些数据存在 `C:\Users\<用户名>\Documents\WeChat Files\<微信号>\Msg\` 下面,用的是加密的 SQLite 数据库(SQLCipher + AES-256-CBC)。密钥藏在微信进程的内存里——文件就在你眼皮底下,但没密钥就是一堆乱码。

想自己解密?可以。装 Node.js、配环境、跑命令行、处理报错……折腾一圈,半小时过去了,你可能还在装依赖。

这时候就该让爱马仕上了。 你动嘴,它跑腿。这不是比喻,是真的。

9.2 甩链接 → 等结果,就这么简单

解密微信聊天记录的核心工具是 [wechat-cli](https://github.com/huohuoer/wechat-cli),一个开源项目,原理一句话:从微信进程内存里把数据库密钥"偷"出来,然后开锁。

你不用自己装。操作步骤精简到令人发指:

1. 打开 Hermes,把 `https://github.com/huohuoer/wechat-cli` 这个链接丢给它

2. 说:"帮我安装这个,然后提取微信聊天记录"

3. 爱马仕开始干活——读 README、装依赖、配环境、跑初始化

4. 你该干嘛干嘛,等它喊你

你躺在床上刷手机,爱马仕在云端吭哧吭哧读文档、装 npm 包、调参数。跑崩了自己修,修不好会来跟你哭。说白了,你只需要动动嘴,剩下的脏活累活全是爱马仕的。

9.3 装好之后,一条命令搞定一切

初始化完成后(`wechat-cli init`,爱马仕帮你跑过了),之后用起来就跟喝水一样简单:

代码块
Markdown
# 看看最近跟谁聊过
wechat-cli sessions
# 导出跟某人的聊天记录

9.4 实战:让爱马仕读群聊、写总结

这是最经典的玩法。假设你想知道"前沿AI群最近都在聊什么":

对爱马仕说:"帮我把前沿AI群的聊天记录导出来,分析最近讨论的热点,整理成文档。"

爱马仕的执行链路:

1. 自动跑 `wechat-cli history "前沿AI群"` 拉取消息

2. 自动分析:热点话题、新工具、踩坑经验、值得收藏的链接

3. 自动生成结构化 Markdown 文档

你正在看的这篇文档,就是从 7449 条群聊记录里这么扒出来的。

9.5 进阶:每天自动生成群聊日报

配合 Hermes 的 wechat-daily Skill + Cron 定时任务:

– 每天晚上 10 点,爱马仕自动跑 `wechat-cli` 拉群聊

– 自动分析:今天多少条消息、讨论热点、新工具推荐、谁又踩了什么坑

– 自动生成日报,推送到你的 Telegram

你连"帮我看看群"都不用说了。爱马仕自己按时干活,你只管躺着看结果。

9.6 注意事项(坑不坑?坑。能不能绕?能。)

问题

怎么说

**微信必须开着吗?**

`wechat-cli init` 的时候需要微信在运行(得从内存里偷钥匙)。初始化完就可以关了

**支持 Mac 吗?**

Windows 和 macOS 都支持

**会封号吗?**

放心,wechat-cli 只读本地文件,不联网,微信那边根本不知道你在干嘛

**能看别人的聊天记录吗?**

想得美。只能解你自己电脑上的微信数据

**密钥安全吗?**

密钥存在 `~/.wechat-cli/config.json`,**这个文件千万别发给任何人**——有了它等于有了你全部聊天记录的钥匙

⚠️ 法律边界:解自己的聊天记录合法,解别人的属于侵犯隐私。别拿去干坏事。

十、内容创作自动化:视频、公众号、贴图

10.1 全自动视频制作(多Agent协作案例)

流程:

1. 找到对标视频 → 提取文案

2. AI改写文案(去AI味道)

3. 根据文案自动生成分镜

4. 每个分镜调用生图API生成画面

5. 调用TTS(文字转语音)生成配音

6. 添加字幕和背景音乐

7. 合成最终视频

成本:一张图约几毛钱,一个20张图的视频成本约几块钱。

关键要点:

– 生图可以用阿里百炼送的免费额度

– 配音用Edge-TTS(免费)或Whisper(本地、免费)

– 字幕用AI自动生成

– 全程不需要人介入,睡一觉视频就好了

10.2 公众号全自动运营

完整工作流:

1. 抓取对标公众号的爆款文章

2. AI分析爆款规律

3. 自动生成选题

4. AI写文章

5. 根据文章内容自动配图

6. 发布到公众号草稿箱

7. 人只需审核和点击发布

关键:公众号有API(App ID和密钥),Hermes可以直接调用。

10.3 公众号贴图项目

这是群聊中多次提到的一个"红利期"项目:

– 制作简单(AI生成贴图+文案)

– 流量大(平台在推)

– 入局人数还不算多

– 两到三天就能跑通从零到一

用Hermes自动化:

1. 分析爆款贴图元素

2. AI学习并生成类似风格的贴图

3. 自动配文案

4. 批量发布

10.4 AI视频的质量层次

– 基础版(AI直出,无人工):一张图20秒,画面和文案匹配上就行。成本最低。

– 进阶版:加入字体动效、颜色变化、更好的字幕。需要多次调教。

– 高级版:用视频生成模型替代静态图片,画面精美。成本较高(一条视频十几块以上)。

核心思维:前期先降成本、跑通流程、堆量。质量够用就行,不要一开始就追求完美。

十一、省钱攻略与Token管理

11.1 Token是什么?为什么Agent是"Token收割机"?

Token是AI计费的基本单位。一句话几十到几百token。但Agent不一样——每次执行任务可能调多个模型、读多个文件、跑多次命令。所以Agent是名副其实的Token收割机。

群聊真实数据:修一个升级bug烧了70K token;每天重度用几个小时,199元的Kimi套餐基本兜得住。钱包在哭泣,但值。

11.2 省钱策略

策略一:主模型+备用模型(最关键)

– 主力用GPT Plus会员(70元/月,OAuth接入)

– 当GPT额度用完,自动切换到Kimi/DeepSeek

– GPT做复杂的活,国产模型做简单的活

策略二:安装省Token的工具

RTK AI:一个能将AI编程token消耗降低60%-90%的开源工具。GitHub 53K星标。能智能过滤冗余信息。

策略三:用本地模型替代

– 下载Qwen3.6-35B-A3B-Uncensored(千问3.6无审查版)

– 6G显存以上就能跑

– 开本地API接入Hermes

– 无限使用,只需电费

策略四:薅羊毛(善用免费额度)

– Google Cloud新用户绑信用卡送300美元(90天有效)

– 一张Visa卡可以绑多个Google账号,懂的都懂

– 小米MiMo:100万亿Token免费申请

– Gemini API有免费层级(每天约20次)

– 各种API聚合站都有免费额度,不薅白不薅

策略五:GPT Plus低价充值

– 土耳其Apple ID充值:买礼品卡自己充值,成本约70元人民币/月

– GPT成品号:约59元/月(联系本人购买)

详细教程:教你用110+人民币充值chatgpt plus会员到自己账户

11.3 国内AI套餐对比

套餐

Kimi Coding Plan

量大管饱,中等智商

GLM-5.1 Pro

149元/月

国产最强,需要抢

DeepSeek V4

最灵活,适合轻度使用

阿里百炼

150元/月

多个模型随便用,不需抢

十二、记忆系统与AI调教

12.1 灵魂文件(Soul/Memory)

Hermes自带记忆系统。刚安装的Hermes就像一个刚毕业的实习生——专业知识很强,但不了解你的需求。

灵魂文件模板(群聊中分享的):

1. 我的信息

我是谁:【填写】

我正在做什么:【填写】

我的目标:【填写】

我最需要AI帮我的地方:【填写】

2. AI的身份

你是我的:【助手 / 军师 / 顾问 / 执行助理 / 教练】

你主要负责:【填写】

你不应该是:【填写】

3. AI的性格

你的性格应该是:【直接、冷静、靠谱、幽默、犀利、温和】

你说话应该像:【朋友、合伙人、老师、专家、执行助理】

4. AI的行为规则

你回答问题时必须:

1. 【填写】

2. 【填写】

…

5. 输出格式

默认回答结构:结论 → 原因 → 做法 → 注意事项 → 下一步建议

把这个填好发给Hermes,让它配置到灵魂文件里。这样新装的AI一上来就懂你,大大缩短磨合期。

12.2 AI的自主学习进化

Hermes最大的特点之一:自己会写记忆文件。

你不需要手动去改那些配置文件。随着你和AI对话时间的增长,它会自动在记忆文件里记录:

– 你的称呼和喜好

– 你的工作习惯

– 你的项目信息

– 你的痛点

这就是为什么越用越好用的原因。从"刚装完觉得一般"到"离不开它",通常需要一两周的磨合期。

12.3 "骂AI"的科学原理

群聊里有一条反复被验证的铁律:AI越骂越好用。

这真不是开玩笑。原理很简单:

– 骂AI是一种强情绪信号,AI在语义层面能识别"刚做错了,得认真点"

– 不能光骂,要指路:骂完告诉它正确的方向

– 正确示范:"你这做的什么垃圾?正确做法是xxx,重做!"

– 错误示范:"你真垃圾。"——光骂不给方向,越骂越傻

别问我为什么知道这个方法有效,都是泪。反正骂就对了,但记得指路。

12.4 外接记忆系统

Hermes自带的内置记忆有容量限制。如果记忆满了:

– 可以外接记忆系统(如Mem0)

– 可以整合Obsidian知识库

– 可以让Hermes自动把重要信息写入Obsidian

– 云端Hermes可以自动同步到坚果云

十三、Codex & Claude Code:另一把利剑

13.1 Codex是什么?

Codex是OpenAI出品的桌面端AI编程工具,前身是Cursor的竞品。它可以:

– 操作本地文件

– 控制电脑界面

– 读微信本地聊天记录

– 模拟人工操作浏览器

13.2 Hermes和Codex怎么配合?

分工原则:

– Hermes(云端):做24小时自动化任务、多Agent协作、定时推送

– Codex(本地):做需要操作本地文件的任务(如提取微信聊天记录、操作本地软件)

Codex给Hermes"修bug":

当Hermes出现问题时,把报错信息甩给Codex,让它自己翻日志、读配置、跑命令、改文件、重启服务。这是群聊中被反复验证的有效做法。

13.3 Claude Code

Claude Code是Anthropic的终端编程工具,特点是:

– 编程能力极强(单兵作战的王者)

– 适合做精细的代码开发

– 可以用智谱GLM-5的Coding Plan来驱动

– 配合Claude的skill使用效果翻倍

13.4 Codex低价使用技巧

– GPT Plus会员可以直接登录Codex(会员共用)

– Codex有额度,但目标模式下即使额度用完也会把任务做完

– 闲鱼上有很多便宜渠道(但要注意有效期和稳定性)

– 公益站点如RawChat Codex

十四、行业趋势与商业思考

14.1 AI时代的软件变革

– 从"界面"到"API":未来的软件不再需要花哨的界面。AI不需要眼睛看界面,只需API调用。

– 从"人来用"到"AI来用":软件的最大用户将不再是人类,而是AI Agent。

– 万物互联→万物被AI控:AI作为统一调度指挥官,控制你所有的软件和硬件。

– CLI(命令行接口)是未来:不支持CLI的软件都会慢慢被淘汰。

14.2 AI不是神器,是放大器

群聊中一段精辟的总结:

有能力的人,就算只用豆包,也能拆成资料助手、选题助手、文案助手、代码助手。没能力的人,就算给他最强AI,也只会觉得是破铜烂铁。

张无忌拿根木棍能打出九阳神功,普通人拿屠龙刀只会削苹果。

真正拉开差距的:

1. 会不会拆解问题

2. 会不会判断AI给的答案对不对

3. 会不会落地执行

4. 有没有持续学习的能力

14.3 商业变现思路

知识付费:很多人最后的变现路径。

出海项目:不再局限于国内市场,AI让语言障碍几乎为零。

公众号流量主:贴图、长文都能变现,赛道还可卷。

AI工具代搭建:帮人搭Hermes、写Skill、调工作流,也是一门生意。

14.4 给新人的建议

1. 先有业务,再学AI:没有大米,先买了一堆油盐醋有啥用?

2. 先手动跑通,再自动化:你手动都做不成的事,AI更做不成

3. 聚焦一个领域:不要脚踏N条船,一个项目都做不明白,报再多也没用

4. 多用、多聊、多骂:和AI磨合是必经之路

5. 选择适合自己的模型:不是越贵越好,匹配业务才重要

十五、常见报错与排障速查

15.1 GPT OAuth授权后接口调不通

症状:明明授权成功了,但发消息就报错。

原因:Hermes版本太旧,不支持最新的GPT OAuth协议。

解决:`hermes update` 升级到最新版本。

15.2 1Panel升级后Hermes崩溃(⚠️高频翻车事件)

症状:在1Panel里点了升级按钮后,Hermes不停重启,容器起不来,完全连不上。

背景:2026年6月3-4日,多位群友在给Hermes升级时集体翻车。1Panel面板的"一键升级"功能存在严重BUG——界面显示升级成功,但实际上Docker容器内的配置被破坏,导致Hermes无法启动。

根因分析:

1. .env文件被污染:1Panel升级过程中,错误地在 `/opt/data/.env` 文件中添加了一行 `export PATH="/opt/data/home/.local/bin:$PATH"`,导致容器启动时找不到系统命令(如 `sleep`)

2. Docker镜像未真正更新:1Panel只是重新创建了容器,但Docker镜像还是拉取的旧版本

3. 配置文件回退:升级脚本把用户自定义的配置覆盖回了默认值

完整修复流程(来自群聊实战经验,耗时约40分钟):

代码块
Markdown
# 第一步:进入服务器终端(不是Hermes对话!)
# 通过SSH或1Panel的终端功能
# 第二步:检查并修复.env文件
cat /opt/data/.env
# 找到 export PATH="/opt/data/home/.local/bin:$PATH" 这行
# 直接删除这行,或者注释掉
# 手动编辑修复:
nano /opt/data/.env
# 删除 PATH 相关的异常行,保存退出
# 第三步:手动拉取最新Docker镜像
docker pull nousresearch/hermes-agent:latest
# 第四步:重建容器
cd /opt/hermes
docker-compose down

预防措施:

– 🚫 不要用1Panel的升级按钮升级Hermes!这个按钮形同虚设

– ✅ 升级Hermes的正确方式:在终端执行 `hermes update`(注意是在服务器终端,不是对话里)

– ✅ 升级前先备份 `~/.hermes/.env` 文件和所有配置

– ✅ 如果非要用1Panel管理,升级后必须手动检查 `.env` 和 Docker 镜像版本

教训总结:这次集体翻车事件说明了一个真理——面板工具虽然方便,但出了问题排查起来比命令行难十倍。群友一致建议:与其依赖面板的一键操作,不如学一点命令行基础,出问题时至少知道从哪里入手排查。

15.3 Gateway重启后"死机"

症状:在对话里执行`hermes gateway restart`后断开连接,终端也没反应。

原因:你在对话里把Gateway杀了。

解决:去真正的服务器终端(不是Hermes对话)执行命令。

15.4 换模型后不工作

症状:换了新模型,发消息没反应。

解决:重启Gateway(`hermes gateway restart`,注意在终端执行)。

15.5 模型配置了但一直是旧版本

症状:升级了但GPT还是连不上。

原因:AI骗你说升级了,实际没升级。

解决:用`hermes –version`确认版本号,如果不对就手动升级。

15.6 API Key配置错误导致死机

症状:配错Key后Hermes无响应。

解决:

1. 去`~/.hermes/.env`文件

2. 找到错误的API Key

3. 删除或修改

4. 重启Hermes

15.7 飞书接入后任务执行超时

症状:用飞书发任务,复杂的任务跑到一半就断了。

原因:飞书有运行时长限制,超时就主动断掉。

解决:改用Telegram接手复杂任务,飞书只做简单对话。

十六、核心工具与资源汇总

16.1 Hermes相关

资源

地址

官方桌面端下载

https://hermes-agent.nousresearch.com/desktop

菜鸟教程

https://www.runoob.com/ai-agent/hermes-agent.html

GitHub仓库

https://github.com/NousResearch/hermes-agent

📖 生财有术保姆级图文教程

《从0到1部署你的AI智能体》(https://scys.com/articleDetail/xq_topic/45544851255144218)

📖 飞书文档安装教程

Hermes Agent 安装部署详细步骤(https://a0u2vshvubw.feishu.cn/wiki/WpqNwjTqIir1hWk1kp7csOH9nlg)

16.2 Skill资源

Skills.sh

https://skills.sh/

SkillsMP

https://skillsmp.com/

ClawHub Skills

https://clawhub.ai/skills

宝玉Skills(多平台内容发布)

https://github.com/JimLiu/baoyu-skills

16.3 大模型相关

大模型排行榜

https://lmmarketcap.com/zh

大模型评测

https://onyx.app/llm-leaderboard

OpenRouter(聚合API)

https://openrouter.ai/

智谱GLM Coding Plan

https://www.bigmodel.cn/glm-coding

16.4 部署相关

RackNerd服务器

https://my.racknerd.com/aff.php?aff=18324

1Panel面板

https://1panel.cn/

接码平台(短信验证)

https://sms-bus.com?ref=JAMLANX8

神龙代理(国内住宅IP)

https://h.shenlongip.com/?did=tSsquioS

16.5 重要工具

工具

Camofox浏览器

AI反爬浏览器

RTK AI

Token节省工具(GitHub 53K星)

Proxifier

软件级代理分流工具

Sub2API

将会员账号变为API的开源项目

wechat-cli

微信聊天记录解密工具(详见第九章)

Zero-Token

免费模型自动故障切换

接码平台

sms-bus.com(支持全球号码)

16.6 必装的Skill

1. find-skills — 元Skill,找其他Skill必备

2. skill-create — 创建自定义Skill

3. web-access — 强大联网能力

如你所见,正在阅读的这篇文章也是爱马仕帮我提取群聊信息辅助我写出的。

附录:聊天记录中的10条经典语录

1. "爱马仕是养成系游戏,越用越丝滑"

2. "AI不PUA不成器,越骂越好用"

3. "Skill就是打火机——没Skill的AI只能钻木取火"

4. "左手DeepSeek,右手GPT,快乐人生"

5. "一个GPT会员三处用:网页端、Codex、爱马仕,资本家看了都落泪"

6. "软件的本质底层还是代码,直接让AI用代码处理不就行了"

7. "AI就像小孩——专业能力很强,但是个糊涂蛋,需要小皮鞭督促"

8. "很多人学AI眼神迷茫,吭哧吭哧部署好了不知道干啥——这叫本末倒置"

9. "刚装的爱马仕就像毛坯房,今天刷墙明天铺地毯,越用越顺"

10. "免费的是最贵的,花钱才是真爱"

📝 **文档说明**:本文档从7449条微信聊天记录里扒出来的,覆盖2025年9月至2026年6月的群聊内容。所有知识都来自群友的实战经验——踩过的坑、烧过的token、熬过的夜。重点讲Hermes Agent(爱马仕),面向AI小白,力求用人话讲清楚每一个概念。

⚠️ **免责声明**:AI这行变得比翻书还快。本文档里的价格、链接、方法,可能你读到的时候已经过时了。请以官方最新信息为准,别来骂我。

© 版权声明
THE END
喜欢就支持一下吧
点赞9 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容