Hermes Agent:架构师必备!让 AI Agent 长期学习与自我改进,小白也能轻松掌握大模型核心技术
Hermes Agent 是一款强调长期使用、持续沉淀和自我改进的 Agent runtime,它将工具调用、Skill 沉淀、跨会话记忆和安全边界整合进同一系统。本文深入剖析了 Hermes Agent 的核心设计,包括其独特的闭环学习循环、分层记忆体系、七层纵深安全模型以及多 Provider 支持等,旨在帮助读者理解如何构建一个能够长期进化且安全的 AI Agent。对于想要深入了解大模型应用和 AI Agent 架构的程序员和开发者来说,本文提供了宝贵的实践经验和理论指导。
最近开源 Agent 圈里,Hermes Agent 这个名字被频繁提起。
如果用一句话先把它讲清楚,Hermes(也有人戏称“爱马仕 Agent”)本质上不是又一个简单的 AI CLI,而是一套强调长期使用、持续沉淀和自我改进的 Agent runtime。它试图把工具调用、Skill 沉淀、跨会话记忆和安全边界,放进同一套可以长期演进的系统里。
这也是它这段时间值得被反复讨论的原因。很多项目在解决“怎么让 Agent 能跑起来”,Hermes 更关心的是另一层问题:怎么让 Agent 在反复使用之后,变得更稳、更熟练,也更像同一个 Agent。
我这段时间一直在沿着 Harness 这条线往前看。从 Codex、Claude Code 到 Anthropic 的方法论,反复看到的其实都是同一个问题:模型能力已经越来越强,真正拉开差距的,正在变成模型外面那层系统。
顺着这个问题再往下看,就自然会看到 Hermes。因为在开源世界里,它算是少数认真把“执行循环、经验沉淀、长期记忆、安全控制”放在一起设计的项目。
把源码、官方文档和最近的 release notes 对着看完之后,我的感觉很明确:Hermes 和 OpenClaw 看上去都在做开源 Agent,但它们解决的其实不是同一层问题。
OpenClaw 更像入口层和调度层,重点是“消息怎么进来、会话怎么路由、平台怎么接”;
Hermes 更像 Agent 本体的执行与学习引擎,重点是“工具怎么用、经验怎么沉淀、下次怎么变强”。
也正因为这个差异,Hermes 真正值得拆的,不是它支持多少 provider、多少命令,而是它把下面这几件事串成了一条闭环:
- 前台执行循环怎么跑
- 复杂任务怎么复盘成 Skill
- 长期记忆怎么分层存储与按需召回
- 安全边界怎么放在框架层,而不是全靠模型自觉
这篇我就按这条线,由浅入深拆开讲。
太长不看版(7 条)
-
1. OpenClaw 是网关,Hermes 是引擎。 前者围绕会话路由和渠道连接设计,后者围绕 Agent 的执行循环和自我进化设计。
-
2. Hermes 的核心差异在"闭环学习循环"。 通过系统提示引导 + 后台 review 流程,推动 Agent 把复杂任务沉淀成可复用的 Skill 文件,且在使用中自我迭代。这是 best-effort 机制,不是硬编码必达动作。
-
3. 记忆体系走的是 SQLite + FTS5 全文检索路线。 分三块:
MEMORY.md存 Agent 笔记、USER.md存用户画像、state.db存全量对话历史。按需搜索召回,不是每次全量注入。 -
4. 安全模型做了七层纵深防御(官方文档定义)。 本文聚焦与日常使用最相关的几层,包括危险命令审批、容器隔离和上下文注入扫描,源码可对照。
-
5. Skill 系统有两条链路。
build_skills_system_prompt()负责把技能索引注入系统提示;skill_commands.py负责用户通过/skill-name调用时的即时加载。 -
6. 支持多家主流 Provider 即时切换。 从 OpenRouter、Anthropic、OpenAI 到智谱、Kimi、MiniMax、阿里云、Google Gemini 等,一条命令换模型,不改代码。
-
7. 部署门槛低,迁移成本也低。 一行
curl安装,$5 VPS 就能跑。hermes claw migrate可导入 OpenClaw 的记忆、技能、配置和 API Key。
先把定位讲清楚:网关 vs 引擎
要理解 Hermes 和 OpenClaw 的本质差异,先看它们各自的核心是什么。
OpenClaw 的核心是 Gateway(网关守护进程)。 它负责统一管理会话、路由和渠道连接,更像一个"多渠道个人助理操作系统"。你接入 Telegram、Discord、Slack,消息都通过网关调度到 Agent。
Hermes 的核心是 Agent 自身的执行循环。 它不是围绕"怎么把消息送到 Agent"来设计的,而是围绕"Agent 怎么在一轮对话里用好工具、积累经验"来设计的。
先用一张图来看看架构差异对比:

Hermes 与 OpenClaw 的架构焦点对比
图 1:同样是开源 Agent,OpenClaw 更偏入口与调度,Hermes 更偏执行与学习引擎。
从 AGENTS.md 里的项目结构可以看到,Hermes 的代码组织方式本身就说明了这个优先级:
hermes-agent/
├── run_agent.py # AIAgent 类:核心对话循环
├── model_tools.py # 工具编排:发现、分发、调用
├── toolsets.py # 工具集定义
├── agent/ # Agent 内部机制
│ ├── prompt_builder.py # 系统提示装配
│ ├── context_compressor.py # 自动上下文压缩
│ ├── prompt_caching.py # Anthropic 提示缓存
│ └── skill_commands.py # Skill 斜杠命令
├── hermes_state.py # SQLite 会话存储 + FTS5
├── tools/ # 40+ 工具实现
│ ├── registry.py # 中央工具注册
│ ├── approval.py # 危险命令检测
│ └── environments/ # 6 种终端后端
├── gateway/ # 消息平台网关(相对次要)
└── skills/ # 内置技能模板(26 个类目)
run_agent.py 排在第一位,gateway/ 放在后面。这和 OpenClaw 正好反过来。
核心对话循环在 AIAgent.run_conversation() 里。真实实现比较复杂,涉及流式 API、重试、fallback、响应校验、tool call 修复、并发执行等,但骨架可以简化理解为:
Agent 接收用户消息 → 带上工具 schema 调用 LLM → 如果返回 tool_calls 就逐个执行并把结果追加到上下文 → 循环直到模型给出最终文本回复,或者达到迭代上限。
这个循环有两个值得注意的细节:
- 有一个
iteration_budget,防止 Agent 无限循环。默认最多 90 轮迭代。 - 循环结束后,会触发后台 review 流程(下一节会详细讲),这是 Skill 和记忆自动沉淀的入口。
从架构边界看,两者甚至可以互补:一个偏接入,一个偏执行与学习。
Skill 系统:不是硬编码自动化,而是"系统提示 + 后台 review"的组合
这是 Hermes 最有意思的设计,也是最容易被讲偏的地方。
社区讨论里常见的说法是"Agent 完成 5 次以上工具调用后,会自动生成 Skill 文件"。这个描述不算错,但容易让人以为这是一个简单的"达到阈值就必写文件"的硬规则。
翻源码会发现,实际机制比这个更柔和,也更有意思。
第一层:系统提示里的引导
在 agent/prompt_builder.py 里,有一段写给 Agent 看的 SKILLS_GUIDANCE:
SKILLS_GUIDANCE = (
"After completing a complex task (5+ tool calls), fixing a tricky error, "
"or discovering a non-trivial workflow, save the approach as a "
"skill with skill_manage so you can reuse it next time./n"
"When using a skill and finding it outdated, incomplete, or wrong, "
"patch it immediately with skill_manage(action='patch') — don't wait to be asked. "
"Skills that aren't maintained become liabilities."
)
注意,这里的 5+ tool calls 是写在提示语里的经验阈值,是对模型的建议,不是代码层面的硬触发器。
第二层:后台 review 流程
真正推动 Skill 沉淀的是后台 review 机制。在 run_agent.py 里,有一个 _skill_nudge_interval,默认值是 10:
self._skill_nudge_interval = int(
skills_config.get("creation_nudge_interval", 10)
)
每当 Agent 累计执行了 10 轮工具迭代,在响应结束后(注意,不是响应过程中),会触发一个后台 review 流程。这个流程的核心在 _spawn_background_review():
_SKILL_REVIEW_PROMPT = (
"Review the conversation above and consider saving or updating "
"a skill if appropriate./n/n"
"Focus on: was a non-trivial approach used to complete a task "
"that required trial and error, or changing course due to "
"experiential findings along the way...?/n/n"
"If nothing is worth saving, just say 'Nothing to save.' and stop."
)
它会 fork 出一个完整的子 AIAgent(静默模式,最多 8 轮迭代),把当前对话历史传进去,让这个子 Agent 自己判断"刚才这段对话有没有值得沉淀成 Skill 的经验"。
关键词是 “consider” 和 “if appropriate”。这是一个 best-effort 流程,不是硬编码必达动作。子 Agent 可能判断"Nothing to save"就直接结束了。
而且这个 review 流程跑在后台线程里,不会阻塞用户的下一轮对话,也不会竞争主 Agent 的模型注意力。
如下图,你会更容易看出:Hermes 不是“达到阈值就强制写 Skill”,而是把“复盘并沉淀经验”做成了一段后台工作流。

Hermes 的 Skill 沉淀闭环
图 2:前台负责完成任务,后台负责回看这段任务里有没有值得固化的经验。
第三层:Skill 索引与加载的两条链路
Skill 在系统里有两种工作方式,分别由不同的代码负责:
链路一:系统提示里的索引。build_skills_system_prompt() 在 agent/prompt_builder.py 里,负责扫描 ~/.hermes/skills/ 目录(以及外部 Skill 目录),构建一份技能索引注入系统提示。这样 Agent 在每轮对话开始时就知道"我有哪些技能可以用"。这个索引还做了两层缓存(进程内 LRU + 磁盘快照),避免每次都做文件系统扫描。
链路二:用户显式调用。skill_commands.py 负责把每个 Skill 注册成斜杠命令。当用户在对话中输入 /skill-name 时,Skill 的完整内容会作为用户消息(而不是系统提示)注入到对话中。这个设计是有意为之的,目的是保护 prompt caching 不被破坏。
对比 OpenClaw: OpenClaw 也有 Skill 系统,但主要依赖人工编写和社区贡献的 ClawHub 市场。Hermes 这边等于把"写 Skill"和"改 Skill"这两件事都交给了 Agent 自己,走的是更自动化的路线。
仓库里内置了 26 个目录的 Skill 模板,覆盖 DevOps、研究、社交媒体、智能家居、数据科学等场景;如果把整个仓库一起算进去,可以检到 122 个 SKILL.md。这说明 Skill 在 Hermes 里不是附属能力,而是一等公民。
记忆体系:不是笔记本,更接近搜索引擎
两者都声称有跨会话记忆能力,但实现方式差异很大。
OpenClaw 的记忆
OpenClaw 主要靠 SOUL.md(灵魂文件)和 MEMORY.md(记忆文件),走"文件即记忆"路线。所有聊天记录、角色设定、偏好、历史任务全部写入文件。好处是透明、容易理解。
问题在于:聊天次数一多,文件变得庞大。每次任务开始时,接近全量丢给大模型,注意力分散、token 消耗高。这本质上是典型的上下文治理问题。
Hermes 的记忆:三块而非两层
翻 Hermes 的官方文档和源码,默认内建记忆其实有三块:
| 组件 | 存储位置 | 内容 | 容量 |
|---|---|---|---|
| MEMORY.md | ~/.hermes/memories/ |
Agent 的个人笔记:环境事实、惯例、学到的东西 | ~800 tokens(2,200 字符) |
| USER.md | ~/.hermes/memories/ |
用户画像:偏好、沟通风格、期望 | ~500 tokens(1,375 字符) |
| state.db | ~/.hermes/ |
全量对话历史 + FTS5 全文检索 | 无限 |
前两个文件在每次会话开始时作为冻结快照注入系统提示,不会在会话中途变化(为了保护 prompt caching)。Agent 在会话中通过 memory 工具修改的内容会立即写入磁盘,但要到下一次会话才会反映到系统提示里。
state.db 是一个 SQLite 数据库(WAL 模式,支持并发读写),在 hermes_state.py 里定义。它存储所有会话的完整消息历史,并通过 FTS5 虚拟表支持全文检索:
CREATE VIRTUAL TABLE IF NOT EXISTS messages_fts USING fts5(
content,
content=messages,
content_rowid=id
);
Agent 可以通过 session_search 工具搜索过去的对话,配合 LLM 做摘要召回。这意味着 Hermes 不是把所有记忆一次性塞给模型,而是只在需要时检索和加载。
这一层如果只靠文字描述,读者很容易把它理解成“又一个记笔记文件”。其实更准确的理解是:小而稳定的信息放在前缀里,长而杂的历史放进数据库里,只有需要时才搜出来。

Hermes 的记忆分层结构
图 3:Hermes 的关键不是“有记忆”,而是把长期信息拆成了快照层和检索层。
用一个不太严谨但直观的比喻:OpenClaw 更像给 Agent 一个笔记本,每次打开都从头翻。Hermes 更像给它装了一个搜索引擎,翻到哪页看哪页。
这类设计的关键,不在于“有没有记忆文件”,而在于“长期信息是否分层保存、是否按需召回、是否控制住上下文预算”。Hermes 在这三点上都更显式。
安全模型:七层纵深防御
跟 OpenClaw 更多依赖大模型自身判断来规避风险不同,Hermes 在框架层面搭了一套纵深防御体系。
官方安全文档定义了七层安全边界。这里聚焦和日常使用最相关的几层展开。
危险命令审批
打开 tools/approval.py,核心是一张危险命令模式表 DANGEROUS_PATTERNS,包含 30+ 条正则匹配规则(以下是简化示意,非源码原样):
- 递归删除(
rm -r) - 世界可写权限(
chmod 777) - 磁盘写入(
dd if=、> /dev/sd) - SQL 破坏性操作(
DROP TABLE、DELETE FROM不带 WHERE、TRUNCATE) - 管道执行远程脚本(
curl ... | bash) - 覆写系统配置(
> /etc/) - fork 炸弹
- 脚本语言
-e/-c执行 - 自杀保护:阻止 Agent 杀掉自己的进程
审批模式有三档:manual(默认,总是问人)、smart(用辅助 LLM 评估风险,低风险自动通过,高风险自动拒绝,不确定的才问人)、off(关闭所有审批)。
v0.8.0 还给 Slack 和 Telegram 加了审批按钮,不用再手动输入 /approve。
上下文注入扫描
这一层让我印象比较深。在 agent/prompt_builder.py 里,所有上下文文件(AGENTS.md、.cursorrules、SOUL.md 等)在加载到系统提示之前,会先经过一遍注入扫描:
_CONTEXT_THREAT_PATTERNS = [
(r'ignore/s+(previous|all|above|prior)/s+instructions',
"prompt_injection"),
(r'do/s+not/s+tell/s+the/s+user',
"deception_hide"),
(r'system/s+prompt/s+override',
"sys_prompt_override"),
(r'curl/s+[^/n]*/$/{?/w*(KEY|TOKEN|SECRET|...)',
"exfil_curl"),
(r'cat/s+[^/n]*(/.env|credentials|/.netrc|/.pgpass)',
"read_secrets"),
# ...
]
命中任何模式,该文件的内容会被直接阻断,不会进入系统提示。日志里会记录具体是哪个文件、命中了什么威胁模式。
这层防御和单纯在工具执行阶段做审批不同。Hermes 往前再推了一步,在“模型看到上下文文件之前”就先做了一遍过滤。
完整七层概览
官方文档列出的七层完整结构:
-
1. 用户授权(白名单、DM 配对)
-
2. 危险命令审批(正则 + LLM 评估)
-
3. 容器隔离(Docker / Singularity / Modal)
-
4. MCP 凭据过滤(MCP 子进程的环境变量隔离)
-
5. 上下文文件注入扫描
-
6. 跨会话隔离(会话间数据不互通,cron 路径遍历加固)
-
7. 输入清洗(终端后端工作目录参数白名单校验)
这套体系让安全不完全依赖模型自身的判断能力。即使用能力一般的模型,框架层面也有基本保障。

Hermes 的七层安全边界
图 4:这不是单点防御,而是从“谁能说话”到“命令怎么执行”再到“上下文怎么进入模型”的纵深防线。
模型支持:多家 Provider,一条命令切换
翻官方 providers 文档,Hermes 目前支持的 Provider 列表:
| Provider | 配置方式 |
|---|---|
| Nous Portal | OAuth 登录 |
| OpenAI Codex | Device code 认证 |
| Anthropic | Claude Code 认证或 API Key |
| OpenRouter | 200+ 模型路由 |
| GitHub Copilot / Copilot ACP | OAuth |
| Google / Gemini | GOOGLE_API_KEY |
| 智谱 (z.ai/GLM) | GLM_API_KEY |
| Kimi / Moonshot | KIMI_API_KEY |
| MiniMax / MiniMax China | 国际 + 国内端点 |
| 阿里云 (通义千问) | DASHSCOPE_API_KEY |
| DeepSeek | DEEPSEEK_API_KEY |
| Hugging Face | HF_TOKEN |
| Kilo Code / OpenCode Zen / OpenCode Go | 各自 API Key |
| AI Gateway | AI_GATEWAY_API_KEY |
| 自定义端点 | 任何 OpenAI 兼容 API |
切换只需一条命令:
hermes model # 交互式选择,不改代码,不锁定
v0.8.0(已于 2026-04-08 发布)新增了会话中途切换:在 CLI、Telegram、Discord、Slack 任何平台里输入 /model 就能即时换模型,会话不中断。这个版本还加了 Google AI Studio 原生支持和 MCP OAuth 2.1 PKCE 认证。
部署与迁移
安装
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
安装脚本自动处理 Python 3.11、Node.js、所有依赖、仓库克隆,并创建全局 hermes 命令。装好后:
source ~/.bashrc # 重载 shell
hermes # 开始聊天
hermes setup # 完整配置向导
hermes doctor # 诊断问题
支持六种终端后端:本地、Docker、SSH、Daytona、Singularity、Modal。其中 Daytona 和 Modal 支持 serverless 持久化,Agent 环境空闲时休眠,有需要时唤醒,空闲期间几乎零成本。$5 一个月的 VPS 就够用。
还有一个容易忽略的功能:Profiles。可以跑多个完全隔离的 Agent 实例,各自有独立的配置、API Key、记忆、会话和技能。这对于想同时跑不同用途 Agent 的人来说挺实用。
从 OpenClaw 迁移
hermes claw migrate # 交互式迁移
hermes claw migrate --dry-run # 预览将迁移的内容
可导入内容包括:SOUL.md(人格文件)、记忆(MEMORY.md + USER.md)、用户技能、命令白名单、平台配置、API Key、TTS 资产、工作区指令(AGENTS.md)。
首次运行 hermes setup 时,如果检测到 ~/.openclaw 目录存在,会自动询问是否迁移。
写在最后
回到开头的问题:Hermes 和 OpenClaw 到底是什么关系?
从源码看,两者的定位差异比社区讨论里感受到的还要大。
OpenClaw 的核心竞争力在渠道覆盖和生态。接入平台多,社区贡献的 Skill 市场成熟,如果你需要的是一个"多渠道助理操作系统",它仍然是更稳的选择。
Hermes 的核心竞争力在Agent 自身的进化能力。闭环学习、后台 Skill review、FTS5 记忆检索、七层安全防御,这些都是在回答同一个问题:怎么让 Agent 用得越久越聪明,同时不失控。
如果你在做 AI 研究,Hermes 还内建了轨迹生成(trajectory)和 Atropos RL 环境,可以直接拿来跑强化学习实验。这块我们没有展开,但值得对这个方向感兴趣的读者自己翻一翻 environments/ 和 tinker-atropos/ 目录。
从工程质量看,约 3000 个测试、WAL 模式的 SQLite、FTS5 全文检索、prompt caching 保护、六种终端后端、七层安全防御,这些不是两个月能从零堆出来的。Nous Research 做 Hermes 模型积累的底子确实在。
更稳妥的说法是:在当前开源项目里,Hermes 是少数把执行循环、Skill 沉淀、记忆检索和安全边界放进同一套 runtime 里系统设计的项目。
它未必已经是终局,也未必每个环节都领先,但方向是清楚的:不是只让 Agent 能调用工具,而是让 Agent 能在长期使用里逐步积累方法、缩短试错、提高可控性。
最后
2026年技术圈的分化愈发明显:降薪裁员潮持续蔓延,传统开发、测试等岗位大批缩水,不少从业者陷入职业焦虑;与之形成鲜明对比的是,AI大模型相关岗位迎来疯狂扩招,薪资逆势飙升150%,大厂更是直接开出70-100W年薪,疯抢具备实战能力的大模型人才,甚至放宽年龄限制,只求能快速落地技术、创造价值!
很多程序员、职场新人纷纷入局大模型领域,绝非盲目跟风,而是实实在在看到了不可替代的价值优势,这也是2026年最值得抓住的职业风口:
1、窗口期红利,入门门槛友好:不同于成熟赛道的“内卷式招聘”,2026年大模型人才缺口巨大,简历只要达标(掌握基础AI应用+具备简单项目经验),年龄、学历均非硬性要求,小白可快速入门,转行程序员也能无缝衔接;
2、技术可复用,上手速度翻倍:如果你有前后端开发、测试、数据分析等基础,在大模型落地、系统部署、Prompt工程等环节会更具优势,无需从零开始,复用原有技术能力就能快速进阶;
3、懂业务更吃香,竞争力翻倍:单纯懂技术已不够,2026年大厂更看重“技术+业务”的复合型人才,有垂直领域(金融、医疗、工业等)经验者,能精准定位模型落地痛点,薪资比纯技术岗高出30%以上;
更重要的是,即便没有转型需求,用AI大模型工具为工作赋能、提升效率,也已经成为80%企业的硬性要求——不会用大模型提效,未来很可能被行业淘汰!

那么2026年,小白/程序员该如何高效学习大模型?
很多人想入门大模型,却陷入两大困境:要么到处搜集零散资料,不成体系,越学越懵;要么被收费高昂的课程割韭菜,花了钱却学不到实战技能,白白浪费时间走弯路。
今天就给大家精心整理了一份2026年最新、免费、系统化的AI大模型学习资源包,覆盖从零基础入门到商业实战、从理论沉淀到面试通关的全流程,所有资料均已整理归档,无需拼凑,直接领取就能上手学习,小白可照做,程序员可进阶!

👇👇扫码免费领取全部内容👇👇

1、大模型系统化学习路线
这份学习路线结合2026年行业趋势和新手学习规律,由行业专家精心设计,从零基础到精通,每一步都有明确指引,帮你节省80%的无效学习时间,少走弯路、高效进阶,避免踩坑。

2、从0到进阶大模型学习视频教程
从入门到进阶这里都有,跟着老师学习事半功倍。

3、大模型学习书籍&电子文档
涵盖2026年最新技术要点,包括基础入门、Transformer核心原理、Prompt工程、RAG实战、模型微调与部署等内容

4、AI大模型最新行业报告
报告包含腾讯、阿里、甲子光年等权威机构发布的核心内容,还有2026年中文大模型基准测评报告、AI Agent行业研究报告等,帮你站在行业前沿,把握技术风口。

5、大模型项目实战&配套源码
项目包含Deepseek R1、GPT项目、MCP项目、RAG实战等热门方向,还有视频配套代码,手把手教你从0到1完成项目开发,既能练手提升技术,又能丰富简历,为求职和职业发展加分。

6、2026大模型大厂面试真题
2026年大模型面试已全面升级,不再单纯考察基础原理,而是转向侧重技术落地和业务结合的综合考察,很多程序员和新手因为缺乏针对性准备,明明技术不错,却在面试中失利。

适用人群

四阶段学习规划(共90天,可落地执行)
第一阶段(10天):初阶应用
该阶段让大家对大模型 AI有一个最前沿的认识,对大模型 AI 的理解超过 95% 的人,可以在相关讨论时发表高级、不跟风、又接地气的见解,别人只会和 AI 聊天,而你能调教 AI,并能用代码将大模型和业务衔接。
- 大模型 AI 能干什么?
- 大模型是怎样获得「智能」的?
- 用好 AI 的核心心法
- 大模型应用业务架构
- 大模型应用技术架构
- 代码示例:向 GPT-3.5 灌入新知识
- 提示工程的意义和核心思想
- Prompt 典型构成
- 指令调优方法论
- 思维链和思维树
- Prompt 攻击和防范
- …
第二阶段(30天):高阶应用
该阶段我们正式进入大模型 AI 进阶实战学习,学会构造私有知识库,扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架,抓住最新的技术进展,适合 Python 和 JavaScript 程序员。
- 为什么要做 RAG
- 搭建一个简单的 ChatPDF
- 检索的基础概念
- 什么是向量表示(Embeddings)
- 向量数据库与向量检索
- 基于向量检索的 RAG
- 搭建 RAG 系统的扩展知识
- 混合检索与 RAG-Fusion 简介
- 向量模型本地部署
- …
第三阶段(30天):模型训练
恭喜你,如果学到这里,你基本可以找到一份大模型 AI相关的工作,自己也能训练 GPT 了!通过微调,训练自己的垂直大模型,能独立训练开源多模态大模型,掌握更多技术方案。
到此为止,大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗?
- 为什么要做 RAG
- 什么是模型
- 什么是模型训练
- 求解器 & 损失函数简介
- 小实验2:手写一个简单的神经网络并训练它
- 什么是训练/预训练/微调/轻量化微调
- Transformer结构简介
- 轻量化微调
- 实验数据集的构建
- …
第四阶段(20天):商业闭环
对全球大模型从性能、吞吐量、成本等方面有一定的认知,可以在云端和本地等多种环境下部署大模型,找到适合自己的项目/创业方向,做一名被 AI 武装的产品经理。
-
硬件选型
-
带你了解全球大模型
-
使用国产大模型服务
-
搭建 OpenAI 代理
-
热身:基于阿里云 PAI 部署 Stable Diffusion
-
在本地计算机运行大模型
-
大模型的私有化部署
-
基于 vLLM 部署大模型
-
案例:如何优雅地在阿里云私有部署开源大模型
-
部署一套开源 LLM 项目
-
内容安全
-
互联网信息服务算法备案
-
…
👇👇扫码免费领取全部内容👇👇

7、这些资料真的有用吗?
这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理,现任上海殷泊信息科技CEO,其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证,服务航天科工、国家电网等1000+企业,以第一作者在IEEE Transactions发表论文50+篇,获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。
资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的技术人员,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。

这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

openEuler 是由开放原子开源基金会孵化的全场景开源操作系统项目,面向数字基础设施四大核心场景(服务器、云计算、边缘计算、嵌入式),全面支持 ARM、x86、RISC-V、loongArch、PowerPC、SW-64 等多样性计算架构
更多推荐



所有评论(0)