本文档从7449条群聊记录里扒出来的,覆盖Hermes Agent的前世今生。面向零基础小白,看完你也可以是那个懂AI的人。
2026年了,AI大模型已经强到能写代码、能做视频、能帮你赚钱——但绝大多数人还在把它当百度用。问个问题,复制粘贴答案,然后该干嘛干嘛。
聊天框里的GPT就像一个被困在笼子里的猛兽。它空有一身本事,但你没有给它"手"和"脚",它只能陪你聊天。而AI Agent做的事情,就是把笼子打开——让AI能读你的文件、操控你的浏览器、定时执行任务、自己给自己排工作计划。
说白了,这是从"你伺候AI"到"AI伺候你"。
这篇文章里有什么?
这不是那种"AI将改变世界"的泛泛而谈。这里面的每一个知识点,都是从7449条真实的群聊记录里扒出来的——群里有程序员、运营、创业者、内容创作者,大家每天在群里交流怎么用AI赚钱、踩坑经验分享、怎么省钱、怎么用AI提效。
16个章节,全是干货:
这本教程将带你从零开始,一步步走进 AI Agent 的世界。我们会讲清楚:Agent 是什么、怎么装、怎么调教、怎么让它变成你的私人助理。无论你是想提高工作效率、做内容创作,还是寻找商业机会,这里都有你需要的知识。
一、什么是AI Agent?先理解底层概念
1.1 AI Agent不是聊天机器人
很多人以为AI Agent就是一个能聊天的机器人。这是天大的误会。
聊天机器人:你问一句,它答一句。没有自主行动能力,记忆有限,每次对话都是"重新开始"。
AI Agent:一个拥有"手"和"脑"的AI。它不仅能和你对话,还能:
– 操作你的文件系统(读、写、删除、创建)
– 执行终端命令(安装软件、配置环境、运行脚本)
– 访问网络(抓取数据、调用API、控制浏览器)
– 自我进化(根据你的使用习惯调整自己的行为)
– 定时执行任务(你不说话它也能干活)
用群聊里的一个经典比喻来理解:AI Agent就像一个实习生——它有很强的专业知识,但缺乏主动性。你需要告诉它做什么,偶尔骂它两句(真的有用),它就会越干越好。
1.2 Agent的核心三要素
说白了,任何一个AI Agent就三样东西:
1. 大模型(大脑):决定Agent聪不聪明。GPT、Claude、DeepSeek,丰俭由人。
2. 工具/技能(双手):就是Skill和MCP。没工具的Agent就像没打火机的原始人——只能钻木取火,累个半死还没点着。有了工具,咔嚓一下,火来了。
3. 记忆系统(经验):Agent记住你是谁、你喜欢啥、你做过什么。好的记忆系统让Agent越用越懂你,差的记忆系统让你每次都得从头解释"我是谁我在哪我要干嘛"。
1.3 为什么Hermes Agent是这个时代的"宝刀"?
Hermes Agent(中文俗称"爱马仕")是Nous Research开发的开源AI Agent框架。群聊里反复验证过的结论:目前最好用的Agent,没有之一。
之前流行过的OpenClaw(外号"小龙虾"),已经被Hermes全面碾压。核心差距在哪?
– 自主学习进化:用得越久越好用,会自己写记忆文件。小龙虾呢?用久了还是那只龙虾。
– 丰富的内置Skill:装好就能用,不需要从零造轮子
– 多Agent原生支持:可以搞一个Agent军团,分工协作
– 通讯软件接入:Telegram、飞书、微信、QQ都能接,走到哪AI跟到哪
– 活跃的社区:几乎每天都有更新,bug不过夜
二、Hermes Agent(爱马仕)全方位指南
2.1 Hermes究竟是什么?
Hermes Agent是一个开源的AI智能体框架。注意:它自己不带AI能力——AI能力来自你接入的大模型(GPT、DeepSeek等)。
你可以把Hermes理解成智能版的N8N,但爽得多:
– N8N:手动搭工作流、配节点、写代码,累死累活
– Hermes:你张张嘴,它自己搞定一切。真的就是张嘴——对AI说句话就行
2.2 Hermes能做什么?
基于群聊中大量真实使用场景:
场景
具体功能
**内容创作**
自动找爆款→改写文案→AI生图→拼视频→发布草稿
**数据抓取**
抓抖音爆款视频、抓公众号文章、抓小红书笔记
**知识管理**
自动整理知识库到Obsidian、飞书、Notion
**代码开发**
写网页、写小程序、写脚本、自动部署上线
**微信聊天分析**
提取微信聊天记录、生成群聊日报、分析需求信号
**日常助理**
定时推送、监控竞品、自动回复、数据报表
**破解/逆向**
破解软件VIP、分析二进制文件(需本地部署)
2.3 Hermes vs 小龙虾(OpenClaw) vs Claude Code vs Codex
群聊中大量讨论了这几个工具的对比:
特性
Hermes
小龙虾(OpenClaw)
Claude Code
Codex
**上手难度**
中等
较高
较低
**自主学习**
⭐⭐⭐⭐⭐
⭐⭐
⭐⭐⭐
**稳定性**
⭐⭐⭐⭐
**多Agent**
**通讯接入**
极强(多平台)
较强
无
**编程能力**
**适用场景**
全能型
多任务调度
编程专精
文件/界面操作
一句话总结:
– 做编程为主的精细工作用Claude Code
– 做需要操作本地文件/浏览器的用Codex
– 做全自动化的综合业务用Hermes
– 小龙虾是过去式,已经被Hermes全面超越
2.4 Hermes桌面端
2026年5月底,官方终于推出了Hermes Agent桌面端。
下载地址:https://hermes-agent.nousresearch.com/desktop
安装要点(来自群聊踩坑经验):
– 官方安装包目前兼容性一般,很多文件需要在安装时联网下载
– 网络环境差容易卡住或失败
– 建议开TUN模式安装,否则大概率失败
– 如果实在装不上,可以让Codex帮你装
– 桌面端的本质还是命令行,只是加了可视化界面
– 可以用Codex给桌面端做汉化——不是无脑翻译,该保留英文的地方保持不变
2.5 云端部署 vs 本地部署
群聊里被问得最多的问题。答案很简单,但很多人就是想不明白。
云端服务器部署(闭眼选这个):
– ✅ 24小时在线,电脑关了AI还在吭哧吭哧干活
– ✅ 天然在外网,不用折腾什么"魔法"
– ✅ 换设备随便连(手机、平板、任何电脑)
– ✅ 不会误删你本地电脑里的文件(别问我为什么知道,都是泪)
– ❌ 没法直接操控本地电脑的软件界面
– ❌ 服务器要花钱(每月二三十到三四十,一杯奶茶钱)
本地电脑部署(能不用就不用):
– ✅ 可以直接操作本地文件和软件
– ✅ 不用服务器月费
– ✅ 能读微信聊天记录(靠本地Key)
– ❌ 电脑关了AI就歇了
– ❌ Windows适配差到令人发指(建议用Mac或Linux)
– ❌ 新手操作容易误删本地文件……是的,又是泪
– ❌ 得一直保持网络通畅
结论:云端Hermes + 本地Hermes,黄金搭档。云端负责24小时自动化,本地Hermes负责需要操作本地文件的脏活(比如提取微信聊天记录)。
2.6 Hermes的安装方法
安装爱马仕Hermes优先看这个,图文教程更详细:
Hermes保姆级教程生财版:https://scys.com/articleDetail/xq_topic/45544851255144218
Hermes保姆级教程飞书版:从0到1部署你的AI智能体:Hermes Agent 保姆级图文教程,让爱马仕替你打工
是同一篇文章 只是前者是 生财有术平台 后者是 飞书文档 。
这个教程一共讲了两种安装方式分别是:
方法一:命令行直接安装(菜鸟教程方式)⭐推荐
参考菜鸟教程。
适合有一定命令行基础的用户
优点:最纯净、最灵活、升级方便
真实经验:这种方式安装的Hermes最稳定,升级也最方便。缺点是需要一些命令行基础。
方法二:1Panel面板安装
– 适合小白,一键安装
– 缺点:升级困难,容易版本跟不上
– 群聊中多人反映:1Panel里的"升级按钮"点了看起来升级了,但实际上还是旧版本
– 1Panel的Hermes是Docker部署,权限受限,功能不全
– 出现问题后难以排查和修复
⚠️ **2026年6月3-4日翻车事件**:多位群友用1Panel升级后Hermes直接崩溃。原因是升级过程污染了 `.env` 文件,容器找不到系统命令。最终花了40分钟、烧了70K token才修好。详细排查步骤见[第十五章 15.2节](#15)。**建议新手尽量用命令行安装,出问题至少知道从哪里排查。**
2.7 Hermes升级与版本管理
升级命令:
hermes update
注意:这个命令要在终端执行,不是在和AI的对话里发。
查看版本:
hermes –version
升级注意事项(来自血泪教训):
– Hermes的迭代速度极快,几天不升级就可能遇到兼容性问题
– 升级后可能需要重新配置模型
– GPT Plus会员通过OAuth登录时,如果版本太旧会报错——升级到最新即可解决
– 升级后一定要验证版本号,AI有时候会"骗你"说升级好了,实际没升级
– 升级出了问题,新开一个终端对话让AI给你修
2.8 Gateway(网关)
Gateway是Hermes的核心组件,负责消息的接收和转发。
重启Gateway:
hermes gateway restart
⚠️ 注意:这个命令要在终端执行,不要在对话里执行。如果在对话里执行,会把Gateway杀掉,对话自然就断了。
Gateway常见问题:
– 换模型后Gateway可能不响应——重启Gateway即可
– Gateway没有常驻运行会导致机器人"失联"
– 如果卡死,可以先用`kill`杀掉Gateway进程,再重新启动
三、AI大模型的选择与使用
3.1 模型排行榜(群聊实测总结)
国外御三家(天花板级别)
排名
模型
特点
价格
1
Claude
写作文案天花板,逻辑最强
较贵(Pro $200/月)
2
GPT-5.4/5.5
综合能力最强,Agent表现极佳
Plus约70元/月
3
Gemini 3.1/3.5
多模态强,有免费额度
有免费版
国产御三家(能用级别)
DeepSeek V4 Pro
国产最强,排名29,综合86.2
按量计费
GLM-5/5.1
代码能力强,但饥饿营销难抢
149元/月起
Kimi K2.6
综合可用,有包月套餐
199元/月
一句话总结模型选择:
– Claude是爹,GPT是二哥,Gemini是三弟
– 智谱给这三个爹擦皮鞋
– 豆包和DeepSeek是垫脚石(但DeepSeek V4 Pro出来后支棱起来了,国产最强没悬念)
– 有国外模型优先用国外的,国内模型做备胎——很残酷,但这是现实
3.2 模型接入Hermes的方式
方式一:API Key接入
去各模型平台申请API Key,然后在Hermes中配置。
# 在Hermes终端输入:
hermes model
# 然后按提示选择provider,填入API Key
各模型API路径参考:
– GLM(有套餐):`https://open.bigmodel.cn/api/anthropic`
– GLM(无套餐/余额):`https://open.bigmodel.cn/api/paas/v4`
– Kimi Coding Plan:`https://api.kimi.com/coding`
– 阿里百炼(有套餐):`https://coding.dashscope.aliyuncs.com/v1/chat/completions`
方式二:OAuth授权登录
这是个王炸级别的技巧——把网页版GPT Plus会员直接接入Hermes,不用单独买API!
– 选OpenAI provider → OAuth授权
– 浏览器打开授权链接 → 登录GPT → 复制回调URL里的code
– 粘贴回终端,搞定
这意味着什么? 一个70元/月的GPT Plus会员,同时在网页端、Codex、Hermes三个地方用。一鱼三吃,资本家看了都落泪。
方式三:OpenRouter聚合
适合初学者,充$10有每天1000次免费请求。支持DeepSeek V4、Claude Sonnet等多个模型。
主模型 + 备用模型配置(推荐配置):
# 配置文件示例
default: gpt-5.4
provider: openai-codex
base_url: https://chatgpt.com/backend-api/codex
fallback_providers:
– provider: kimi-coding
model: "Kimi K2.6"
base_url: "https://api.kimi.com/coding"
api_key: ""
这样当GPT额度用完后,自动切换到Kimi,不会中断工作。
3.3 各模型适配Hermes的经验
适配情况
注意事项
Plus会员OAuth最方便,额度耗尽自动切备用模型
需API或中转,Pro版不让接Hermes
Gemini
API有限速,免费额度很少
国产最强,但没有视觉模型(不能看图)
GLM-5.1
要抢套餐(每天10点),在海外服务器上会慢
有199元包月套餐,量大管饱,智商中等
Grok
OAuth授权不稳定
豆包
⭐
不适合生产环境,只能做简单任务
3.4 视觉模型(看图)问题
很多群友反馈Hermes不能识别图片。原因在于:
– DeepSeek V4 Pro没有视觉能力,所以用它做主力模型就看不了图
– 解决方案:接入一个有视觉的辅助模型
– 可以接Kimi(有视觉能力)
– 可以接千问的视觉模型
– 可以接豆包识图(虽然豆包很垃圾,但识别图片够用)
– 或者直接切换成GPT(GPT是原生多模态,能看图)
一句话:不是Hermes不能看图,是你请了个"瞎子"当主力模型。换个有眼睛的就行。
四、Skill(技能):AI的武器库
4.1 什么是Skill?
Skill是AI Agent的"打火机"。
用一个经典比喻来理解:你在野外想让AI给你生火。
– 没有Skill的AI:掏出一根木棍开始钻木取火,钻了十分钟磨磨蹭蹭还没成功,然后换个方法找打火石…
– 有Skill的AI:你直接把打火机(Skill)给它,啪!火点着了。
Skill本质上就是写好的代码和提示词,打包成AI可以直接使用的工具。有的Skill是代码、有的是复杂提示词、有的是MCP协议、有的是完整的自动化脚本。
4.2 必须安装的Skill
第一优先级:find-skills
这是元Skill——用来找其他Skill的Skill。
npx skills add https://github.com/vercel-labs/skills –skill find-skills
安装后,你只需要说"我需要一个做PPT的Skill"或"我需要抓小红书的Skill",AI会自动搜索并安装合适的Skill。
Skill搜索网站:
– https://skills.sh/
– https://skillsmp.com/
– https://clawhub.ai/skills
4.3 推荐的Skill清单
根据群聊推荐:
Skill
用途
find-skills
找Skill的Skill,必装
skill-create
创建自定义Skill
web-access
强大的联网访问能力,绕过反爬
wechat-daily
微信群聊日报分析
find-skills里的内容生成
自动写公众号文章、小红书笔记
小红书发布
自动发布小红书笔记
PPT生成
自动制作PPT
AI去味
去掉AI写作的机械感
占星/命理
玄学类自动化
4.4 如何创建自己的Skill
1. 让AI跑一遍你的业务流程
2. 对AI说"把这个流程封装成一个Skill"
3. AI会生成Skill的MD文件
4. 把文件放到Hermes的Skill目录即可
Skill是通用的:Claude Code和Hermes的Skill可以互相使用,因为它们都是MD文件格式。
五、安装部署后配置
5.1 Hermes的多Profile管理
一个Hermes可以创建多个Agent(智能体),每个Agent有独立的:
– 灵魂文件(Soul/Memory)
– 大模型配置
– 对话历史
– Skill配置
访问Hermes的Web面板可以直观管理所有Agent。面板地址一般是`http://<服务器IP>:9119`。
5.2 环境变量配置(.env文件)
Hermes的配置文件在`~/.hermes/.env`。
常见问题:大模型配置错了可以手动编辑这个文件,找到对应的Key删除或修改。
修改后需要重启Gateway让配置生效。
六、通讯软件接入:让AI随时随地为你服务
6.1 各通讯软件对比
通讯软件
适配程度
功能完整性
推荐度
**Telegram**
可发图片/视频/语音/文件
🥇首选
**飞书**
可以,但复杂任务有时超时
🥈备选
**微信**
适配最差,易封号
⚠️慎用
**Discord**
体验好但大陆用不了
Telegram为什么最佳:
– Hermes本身就是国外项目,最适配国外软件
– 可以发图片、视频、语音、文件
– 响应速度快,不会超时断开
– 可以创建多群组,不同群组配不同Agent
微信为什么不推荐:
– 适配最差,功能不完整
– 定时任务推送不了
– 语音适配不好
6.2 接入方法
飞书:一句话让Hermes自己配就行。把飞书开放平台的App ID和Secret发给它。
Telegram:
1. 在Telegram找@BotFather创建机器人
2. 获取Bot Token
3. 在Hermes中配置Bot Token
4. 一个Hermes可以配多个Bot,每个Bot独立工作
微信:
– 微信机器人的配置比较复杂,且仅支持私聊,不支持群聊
– 企业微信的机器人也只能在内部群使用
– 建议非必要不接入微信
6.3 通讯软件的本质
所有通讯软件(飞书、微信、Telegram)本质上都只是一个"显示器"——它们把服务器终端的信息转发到你的手机上。
真正的Agent协作、任务执行都在云端服务器上完成。你选择了什么通讯软件只是选择了不同的"显示器"而已。
七、多Agent协作:从单兵作战到军团作战
7.1 什么是多Agent协作
一个Hermes可以创建多个Agent,每个Agent:
– 有独立的灵魂文件(不同的性格和专长)
– 可以使用不同的大模型
– 可以专注于不同的任务
经典配置(以视频制作为例):
– Agent 1:爆款拆解员
– Agent 2:资料核查员
– Agent 3:文案写手
– Agent 4:字幕/分镜拆分员
– Agent 5:画面生成员
– Agent 6:音频制作员
– Agent 7:剪辑合成员
– Agent 8:终审员
这8个Agent协作完成一条视频,效率远超人类。
7.2 如何配置多Agent协作
1. 升级Hermes到最新版本
2. 创建多个Agent,给每个注入灵魂文件和身份信息
3. 使用看板(Dashboard)给每个Agent分配任务
4. Agent之间可以互相通信、传递数据
以上动作你直接对着你的爱马仕口喷即可。
另一种方式:在Telegram创建群组,把多个Bot拉进去。每个Bot是不同的Agent,可以在群里互相讨论、传递任务。
7.3 多Agent的调度
主Agent负责统一调度,分配任务给各个副Agent。主模型和副模型可以不同:
– 主模型用GPT(智商高,善规划)
– 副模型用Kimi/DeepSeek(便宜,做苦力活)
八、爬虫与数据抓取实战
8.1 爬取策略排名(安全性从高到低)
1. 模拟人工操作(最安全):用无头浏览器模拟人的行为,网站基本检测不到
2. 使用官方/第三方API(安全):有API就用API,结构化的数据最好处理
3. Skill/MCP(中等):基于协议的工具调用,比裸爬虫安全
4. 爬虫脚本(较高风险):容易被反爬机制检测
8.2 反爬突破技巧
核心工具:
– Camofox浏览器:AI反爬浏览器,可以绕过大部分网站的反爬机制
– web-access Skill:强大的联网访问能力
– 模拟浏览器自动化:用CDP协议控制浏览器,模拟真人操作
给Cookie:对于需要登录才能访问的平台(如Instagram),把Cookie发给AI,相当于让它以你的身份登录。
节奏控制:不是一秒发100个请求,而是像一个正常人的浏览速度。这样基本不会触发反爬。
8.3 各平台抓取经验
平台
难度
方法
抖音
有开源的解析工具,给链接就能提取文案和视频
公众号
有开源导出工具(wechat-article-exporter,1万+星)
小红书
用Camofox + 模拟浏览器,或使用MCP
需要登录Cookie,建议用小号操作
飞书文档
低
Hermes直接能读取和导出
九、解密微信聊天记录:把脏活丢给爱马仕
9.1 微信把你的聊天记录锁起来了
先说个残酷的事实:你电脑里存了几十G的微信聊天记录,但你看不了。
微信把这些数据存在 `C:\Users\<用户名>\Documents\WeChat Files\<微信号>\Msg\` 下面,用的是加密的 SQLite 数据库(SQLCipher + AES-256-CBC)。密钥藏在微信进程的内存里——文件就在你眼皮底下,但没密钥就是一堆乱码。
想自己解密?可以。装 Node.js、配环境、跑命令行、处理报错……折腾一圈,半小时过去了,你可能还在装依赖。
这时候就该让爱马仕上了。 你动嘴,它跑腿。这不是比喻,是真的。
9.2 甩链接 → 等结果,就这么简单
解密微信聊天记录的核心工具是 [wechat-cli](https://github.com/huohuoer/wechat-cli),一个开源项目,原理一句话:从微信进程内存里把数据库密钥"偷"出来,然后开锁。
你不用自己装。操作步骤精简到令人发指:
1. 打开 Hermes,把 `https://github.com/huohuoer/wechat-cli` 这个链接丢给它
2. 说:"帮我安装这个,然后提取微信聊天记录"
3. 爱马仕开始干活——读 README、装依赖、配环境、跑初始化
4. 你该干嘛干嘛,等它喊你
你躺在床上刷手机,爱马仕在云端吭哧吭哧读文档、装 npm 包、调参数。跑崩了自己修,修不好会来跟你哭。说白了,你只需要动动嘴,剩下的脏活累活全是爱马仕的。
9.3 装好之后,一条命令搞定一切
初始化完成后(`wechat-cli init`,爱马仕帮你跑过了),之后用起来就跟喝水一样简单:
代码块
Markdown
# 看看最近跟谁聊过
wechat-cli sessions
# 导出跟某人的聊天记录
9.4 实战:让爱马仕读群聊、写总结
这是最经典的玩法。假设你想知道"前沿AI群最近都在聊什么":
对爱马仕说:"帮我把前沿AI群的聊天记录导出来,分析最近讨论的热点,整理成文档。"
爱马仕的执行链路:
1. 自动跑 `wechat-cli history "前沿AI群"` 拉取消息
2. 自动分析:热点话题、新工具、踩坑经验、值得收藏的链接
3. 自动生成结构化 Markdown 文档
你正在看的这篇文档,就是从 7449 条群聊记录里这么扒出来的。
9.5 进阶:每天自动生成群聊日报
配合 Hermes 的 wechat-daily Skill + Cron 定时任务:
– 每天晚上 10 点,爱马仕自动跑 `wechat-cli` 拉群聊
– 自动分析:今天多少条消息、讨论热点、新工具推荐、谁又踩了什么坑
– 自动生成日报,推送到你的 Telegram
你连"帮我看看群"都不用说了。爱马仕自己按时干活,你只管躺着看结果。
9.6 注意事项(坑不坑?坑。能不能绕?能。)
问题
怎么说
**微信必须开着吗?**
`wechat-cli init` 的时候需要微信在运行(得从内存里偷钥匙)。初始化完就可以关了
**支持 Mac 吗?**
Windows 和 macOS 都支持
**会封号吗?**
放心,wechat-cli 只读本地文件,不联网,微信那边根本不知道你在干嘛
**能看别人的聊天记录吗?**
想得美。只能解你自己电脑上的微信数据
**密钥安全吗?**
密钥存在 `~/.wechat-cli/config.json`,**这个文件千万别发给任何人**——有了它等于有了你全部聊天记录的钥匙
⚠️ 法律边界:解自己的聊天记录合法,解别人的属于侵犯隐私。别拿去干坏事。
十、内容创作自动化:视频、公众号、贴图
10.1 全自动视频制作(多Agent协作案例)
流程:
1. 找到对标视频 → 提取文案
2. AI改写文案(去AI味道)
3. 根据文案自动生成分镜
4. 每个分镜调用生图API生成画面
5. 调用TTS(文字转语音)生成配音
6. 添加字幕和背景音乐
7. 合成最终视频
成本:一张图约几毛钱,一个20张图的视频成本约几块钱。
关键要点:
– 生图可以用阿里百炼送的免费额度
– 配音用Edge-TTS(免费)或Whisper(本地、免费)
– 字幕用AI自动生成
– 全程不需要人介入,睡一觉视频就好了
10.2 公众号全自动运营
完整工作流:
1. 抓取对标公众号的爆款文章
2. AI分析爆款规律
3. 自动生成选题
4. AI写文章
5. 根据文章内容自动配图
6. 发布到公众号草稿箱
7. 人只需审核和点击发布
关键:公众号有API(App ID和密钥),Hermes可以直接调用。
10.3 公众号贴图项目
这是群聊中多次提到的一个"红利期"项目:
– 制作简单(AI生成贴图+文案)
– 流量大(平台在推)
– 入局人数还不算多
– 两到三天就能跑通从零到一
用Hermes自动化:
1. 分析爆款贴图元素
2. AI学习并生成类似风格的贴图
3. 自动配文案
4. 批量发布
10.4 AI视频的质量层次
– 基础版(AI直出,无人工):一张图20秒,画面和文案匹配上就行。成本最低。
– 进阶版:加入字体动效、颜色变化、更好的字幕。需要多次调教。
– 高级版:用视频生成模型替代静态图片,画面精美。成本较高(一条视频十几块以上)。
核心思维:前期先降成本、跑通流程、堆量。质量够用就行,不要一开始就追求完美。
十一、省钱攻略与Token管理
11.1 Token是什么?为什么Agent是"Token收割机"?
Token是AI计费的基本单位。一句话几十到几百token。但Agent不一样——每次执行任务可能调多个模型、读多个文件、跑多次命令。所以Agent是名副其实的Token收割机。
群聊真实数据:修一个升级bug烧了70K token;每天重度用几个小时,199元的Kimi套餐基本兜得住。钱包在哭泣,但值。
11.2 省钱策略
策略一:主模型+备用模型(最关键)
– 主力用GPT Plus会员(70元/月,OAuth接入)
– 当GPT额度用完,自动切换到Kimi/DeepSeek
– GPT做复杂的活,国产模型做简单的活
策略二:安装省Token的工具
RTK AI:一个能将AI编程token消耗降低60%-90%的开源工具。GitHub 53K星标。能智能过滤冗余信息。
策略三:用本地模型替代
– 下载Qwen3.6-35B-A3B-Uncensored(千问3.6无审查版)
– 6G显存以上就能跑
– 开本地API接入Hermes
– 无限使用,只需电费
策略四:薅羊毛(善用免费额度)
– Google Cloud新用户绑信用卡送300美元(90天有效)
– 一张Visa卡可以绑多个Google账号,懂的都懂
– 小米MiMo:100万亿Token免费申请
– Gemini API有免费层级(每天约20次)
– 各种API聚合站都有免费额度,不薅白不薅
策略五:GPT Plus低价充值
– 土耳其Apple ID充值:买礼品卡自己充值,成本约70元人民币/月
– GPT成品号:约59元/月(联系本人购买)
详细教程:教你用110+人民币充值chatgpt plus会员到自己账户
11.3 国内AI套餐对比
套餐
Kimi Coding Plan
量大管饱,中等智商
GLM-5.1 Pro
149元/月
国产最强,需要抢
DeepSeek V4
最灵活,适合轻度使用
阿里百炼
150元/月
多个模型随便用,不需抢
十二、记忆系统与AI调教
12.1 灵魂文件(Soul/Memory)
Hermes自带记忆系统。刚安装的Hermes就像一个刚毕业的实习生——专业知识很强,但不了解你的需求。
灵魂文件模板(群聊中分享的):
1. 我的信息
我是谁:【填写】
我正在做什么:【填写】
我的目标:【填写】
我最需要AI帮我的地方:【填写】
2. AI的身份
你是我的:【助手 / 军师 / 顾问 / 执行助理 / 教练】
你主要负责:【填写】
你不应该是:【填写】
3. AI的性格
你的性格应该是:【直接、冷静、靠谱、幽默、犀利、温和】
你说话应该像:【朋友、合伙人、老师、专家、执行助理】
4. AI的行为规则
你回答问题时必须:
1. 【填写】
2. 【填写】
…
5. 输出格式
默认回答结构:结论 → 原因 → 做法 → 注意事项 → 下一步建议
把这个填好发给Hermes,让它配置到灵魂文件里。这样新装的AI一上来就懂你,大大缩短磨合期。
12.2 AI的自主学习进化
Hermes最大的特点之一:自己会写记忆文件。
你不需要手动去改那些配置文件。随着你和AI对话时间的增长,它会自动在记忆文件里记录:
– 你的称呼和喜好
– 你的工作习惯
– 你的项目信息
– 你的痛点
这就是为什么越用越好用的原因。从"刚装完觉得一般"到"离不开它",通常需要一两周的磨合期。
12.3 "骂AI"的科学原理
群聊里有一条反复被验证的铁律:AI越骂越好用。
这真不是开玩笑。原理很简单:
– 骂AI是一种强情绪信号,AI在语义层面能识别"刚做错了,得认真点"
– 不能光骂,要指路:骂完告诉它正确的方向
– 正确示范:"你这做的什么垃圾?正确做法是xxx,重做!"
– 错误示范:"你真垃圾。"——光骂不给方向,越骂越傻
别问我为什么知道这个方法有效,都是泪。反正骂就对了,但记得指路。
12.4 外接记忆系统
Hermes自带的内置记忆有容量限制。如果记忆满了:
– 可以外接记忆系统(如Mem0)
– 可以整合Obsidian知识库
– 可以让Hermes自动把重要信息写入Obsidian
– 云端Hermes可以自动同步到坚果云
十三、Codex & Claude Code:另一把利剑
13.1 Codex是什么?
Codex是OpenAI出品的桌面端AI编程工具,前身是Cursor的竞品。它可以:
– 操作本地文件
– 控制电脑界面
– 读微信本地聊天记录
– 模拟人工操作浏览器
13.2 Hermes和Codex怎么配合?
分工原则:
– Hermes(云端):做24小时自动化任务、多Agent协作、定时推送
– Codex(本地):做需要操作本地文件的任务(如提取微信聊天记录、操作本地软件)
Codex给Hermes"修bug":
当Hermes出现问题时,把报错信息甩给Codex,让它自己翻日志、读配置、跑命令、改文件、重启服务。这是群聊中被反复验证的有效做法。
13.3 Claude Code
Claude Code是Anthropic的终端编程工具,特点是:
– 编程能力极强(单兵作战的王者)
– 适合做精细的代码开发
– 可以用智谱GLM-5的Coding Plan来驱动
– 配合Claude的skill使用效果翻倍
13.4 Codex低价使用技巧
– GPT Plus会员可以直接登录Codex(会员共用)
– Codex有额度,但目标模式下即使额度用完也会把任务做完
– 闲鱼上有很多便宜渠道(但要注意有效期和稳定性)
– 公益站点如RawChat Codex
十四、行业趋势与商业思考
14.1 AI时代的软件变革
– 从"界面"到"API":未来的软件不再需要花哨的界面。AI不需要眼睛看界面,只需API调用。
– 从"人来用"到"AI来用":软件的最大用户将不再是人类,而是AI Agent。
– 万物互联→万物被AI控:AI作为统一调度指挥官,控制你所有的软件和硬件。
– CLI(命令行接口)是未来:不支持CLI的软件都会慢慢被淘汰。
14.2 AI不是神器,是放大器
群聊中一段精辟的总结:
有能力的人,就算只用豆包,也能拆成资料助手、选题助手、文案助手、代码助手。没能力的人,就算给他最强AI,也只会觉得是破铜烂铁。
张无忌拿根木棍能打出九阳神功,普通人拿屠龙刀只会削苹果。
真正拉开差距的:
1. 会不会拆解问题
2. 会不会判断AI给的答案对不对
3. 会不会落地执行
4. 有没有持续学习的能力
14.3 商业变现思路
知识付费:很多人最后的变现路径。
出海项目:不再局限于国内市场,AI让语言障碍几乎为零。
公众号流量主:贴图、长文都能变现,赛道还可卷。
AI工具代搭建:帮人搭Hermes、写Skill、调工作流,也是一门生意。
14.4 给新人的建议
1. 先有业务,再学AI:没有大米,先买了一堆油盐醋有啥用?
2. 先手动跑通,再自动化:你手动都做不成的事,AI更做不成
3. 聚焦一个领域:不要脚踏N条船,一个项目都做不明白,报再多也没用
4. 多用、多聊、多骂:和AI磨合是必经之路
5. 选择适合自己的模型:不是越贵越好,匹配业务才重要
十五、常见报错与排障速查
15.1 GPT OAuth授权后接口调不通
症状:明明授权成功了,但发消息就报错。
原因:Hermes版本太旧,不支持最新的GPT OAuth协议。
解决:`hermes update` 升级到最新版本。
15.2 1Panel升级后Hermes崩溃(⚠️高频翻车事件)
症状:在1Panel里点了升级按钮后,Hermes不停重启,容器起不来,完全连不上。
背景:2026年6月3-4日,多位群友在给Hermes升级时集体翻车。1Panel面板的"一键升级"功能存在严重BUG——界面显示升级成功,但实际上Docker容器内的配置被破坏,导致Hermes无法启动。
根因分析:
1. .env文件被污染:1Panel升级过程中,错误地在 `/opt/data/.env` 文件中添加了一行 `export PATH="/opt/data/home/.local/bin:$PATH"`,导致容器启动时找不到系统命令(如 `sleep`)
2. Docker镜像未真正更新:1Panel只是重新创建了容器,但Docker镜像还是拉取的旧版本
3. 配置文件回退:升级脚本把用户自定义的配置覆盖回了默认值
完整修复流程(来自群聊实战经验,耗时约40分钟):
代码块
Markdown
# 第一步:进入服务器终端(不是Hermes对话!)
# 通过SSH或1Panel的终端功能
# 第二步:检查并修复.env文件
cat /opt/data/.env
# 找到 export PATH="/opt/data/home/.local/bin:$PATH" 这行
# 直接删除这行,或者注释掉
# 手动编辑修复:
nano /opt/data/.env
# 删除 PATH 相关的异常行,保存退出
# 第三步:手动拉取最新Docker镜像
docker pull nousresearch/hermes-agent:latest
# 第四步:重建容器
cd /opt/hermes
docker-compose down
预防措施:
– 🚫 不要用1Panel的升级按钮升级Hermes!这个按钮形同虚设
– ✅ 升级Hermes的正确方式:在终端执行 `hermes update`(注意是在服务器终端,不是对话里)
– ✅ 升级前先备份 `~/.hermes/.env` 文件和所有配置
– ✅ 如果非要用1Panel管理,升级后必须手动检查 `.env` 和 Docker 镜像版本
教训总结:这次集体翻车事件说明了一个真理——面板工具虽然方便,但出了问题排查起来比命令行难十倍。群友一致建议:与其依赖面板的一键操作,不如学一点命令行基础,出问题时至少知道从哪里入手排查。
15.3 Gateway重启后"死机"
症状:在对话里执行`hermes gateway restart`后断开连接,终端也没反应。
原因:你在对话里把Gateway杀了。
解决:去真正的服务器终端(不是Hermes对话)执行命令。
15.4 换模型后不工作
症状:换了新模型,发消息没反应。
解决:重启Gateway(`hermes gateway restart`,注意在终端执行)。
15.5 模型配置了但一直是旧版本
症状:升级了但GPT还是连不上。
原因:AI骗你说升级了,实际没升级。
解决:用`hermes –version`确认版本号,如果不对就手动升级。
15.6 API Key配置错误导致死机
症状:配错Key后Hermes无响应。
解决:
1. 去`~/.hermes/.env`文件
2. 找到错误的API Key
3. 删除或修改
4. 重启Hermes
15.7 飞书接入后任务执行超时
症状:用飞书发任务,复杂的任务跑到一半就断了。
原因:飞书有运行时长限制,超时就主动断掉。
解决:改用Telegram接手复杂任务,飞书只做简单对话。
十六、核心工具与资源汇总
16.1 Hermes相关
资源
地址
官方桌面端下载
https://hermes-agent.nousresearch.com/desktop
菜鸟教程
https://www.runoob.com/ai-agent/hermes-agent.html
GitHub仓库
https://github.com/NousResearch/hermes-agent
📖 生财有术保姆级图文教程
《从0到1部署你的AI智能体》(https://scys.com/articleDetail/xq_topic/45544851255144218)
📖 飞书文档安装教程
Hermes Agent 安装部署详细步骤(https://a0u2vshvubw.feishu.cn/wiki/WpqNwjTqIir1hWk1kp7csOH9nlg)
16.2 Skill资源
Skills.sh
https://skills.sh/
SkillsMP
https://skillsmp.com/
ClawHub Skills
https://clawhub.ai/skills
宝玉Skills(多平台内容发布)
https://github.com/JimLiu/baoyu-skills
16.3 大模型相关
大模型排行榜
https://lmmarketcap.com/zh
大模型评测
https://onyx.app/llm-leaderboard
OpenRouter(聚合API)
https://openrouter.ai/
智谱GLM Coding Plan
https://www.bigmodel.cn/glm-coding
16.4 部署相关
RackNerd服务器
https://my.racknerd.com/aff.php?aff=18324
1Panel面板
https://1panel.cn/
接码平台(短信验证)
https://sms-bus.com?ref=JAMLANX8
神龙代理(国内住宅IP)
https://h.shenlongip.com/?did=tSsquioS
16.5 重要工具
工具
Camofox浏览器
AI反爬浏览器
RTK AI
Token节省工具(GitHub 53K星)
Proxifier
软件级代理分流工具
Sub2API
将会员账号变为API的开源项目
wechat-cli
微信聊天记录解密工具(详见第九章)
Zero-Token
免费模型自动故障切换
接码平台
sms-bus.com(支持全球号码)
16.6 必装的Skill
1. find-skills — 元Skill,找其他Skill必备
2. skill-create — 创建自定义Skill
3. web-access — 强大联网能力
如你所见,正在阅读的这篇文章也是爱马仕帮我提取群聊信息辅助我写出的。
附录:聊天记录中的10条经典语录
1. "爱马仕是养成系游戏,越用越丝滑"
2. "AI不PUA不成器,越骂越好用"
3. "Skill就是打火机——没Skill的AI只能钻木取火"
4. "左手DeepSeek,右手GPT,快乐人生"
5. "一个GPT会员三处用:网页端、Codex、爱马仕,资本家看了都落泪"
6. "软件的本质底层还是代码,直接让AI用代码处理不就行了"
7. "AI就像小孩——专业能力很强,但是个糊涂蛋,需要小皮鞭督促"
8. "很多人学AI眼神迷茫,吭哧吭哧部署好了不知道干啥——这叫本末倒置"
9. "刚装的爱马仕就像毛坯房,今天刷墙明天铺地毯,越用越顺"
10. "免费的是最贵的,花钱才是真爱"
📝 **文档说明**:本文档从7449条微信聊天记录里扒出来的,覆盖2025年9月至2026年6月的群聊内容。所有知识都来自群友的实战经验——踩过的坑、烧过的token、熬过的夜。重点讲Hermes Agent(爱马仕),面向AI小白,力求用人话讲清楚每一个概念。
⚠️ **免责声明**:AI这行变得比翻书还快。本文档里的价格、链接、方法,可能你读到的时候已经过时了。请以官方最新信息为准,别来骂我。











暂无评论内容