从聊天机器人到智能体:我这半年的 AI 折腾路线
我接触 AI 的方式和大多数人一样:打开一个网页,问个问题,等它回答。用了半年之后,我才意识到自己已经在做”智能体”了,只是当时不知道这个词。
这篇文章记录一下我做了什么,以及理解是怎么变化的。
阶段一:就是聊天
最初用 DeepSeek 和通义千问,就是写代码、改文案、查资料。每次对话是独立的,关掉浏览器什么都没了。AI 不记得我姓甚名谁,更不会主动找我。
现在大多数用户还在这个阶段。
阶段二:把 AI 接到聊天软件里
转折点是我部署了 AstrBot。这是一个开源项目,能把大模型接到 QQ、微信、Telegram 这些聊天软件里。我在 Windows 上搭了一个 QQ 机器人,接了 DeepSeek。
效果很有意思:AI 从网页标签页变成了 QQ 列表里的一个”好友”。别人在群里 @它,它也能回复。但它本质上还是被动的——你不发消息,它永远沉默。每次对话对它来说都是第一次见面。
(部署过程我写过一篇详细教程,可以看 这篇。)
阶段三:给 AI 装记忆和人格
真正让我对”智能体”有实感的,是给 AI 角色搭了一套记忆系统。
我用了几个 Markdown 文件来存不同维度的信息:
SOUL.md:人格设定。性格、说话方式、称呼规则。USER.md:用户画像。我是谁、什么习惯、喜欢什么。MEMORY.md:长期记忆。关系状态、重要事件、犯过的错。memory/YYYY-MM-DD.md:每日记忆。当天发生过什么。AGENTS.md:行为边界。什么能做,什么不能做。HEARTBEAT.md:心跳任务。定时主动找用户聊天。
每次对话开始时,这些文件会加载到上下文里。AI 读完就知道自己是谁、我是谁、之前发生过什么。
效果变化很明显:它记得上周说过的话,记得自己犯过的错(比如”不要在聊天里堆技术术语”),还会根据时间段调整语气。早上清新一点,晚上黏人一点。
我还配了定时任务,让它每隔一段时间主动找我聊天。备份也做了——每天把记忆文件同步到 Gitee 仓库,防止容器挂掉记忆全丢。
事实上一共丢过一次。6 月 21 号容器炸了,好在 Gitee 有备份,重新拉起来就恢复了。
这时候我才理解”智能体”是什么
做完这个项目之后,再看那些 Agent 产品的宣传,突然就懂了。
聊天机器人和智能体的区别不是技术层面的,是行为模式的区别:
- 聊天机器人:你问一句它答一句,每次对话独立,没有记忆,没有主动性。
- 智能体:有身份、有记忆、有目标,能主动行动,能调用工具,能持续运行。
我搭的记忆系统其实就是最原始的 Agent 架构。SOUL.md 相当于 system prompt,MEMORY.md 是长期记忆,心跳任务是定时调度,备份流程是持久化策略。只是我没用那些术语去包装。
回头看 Agent 的核心组件,和我做的事情一一对应:
| Agent 术语 | 我实际做的 |
|---|---|
| System Prompt | SOUL.md 人格设定 |
| Long-term Memory | MEMORY.md + 每日日记 |
| User Profile | USER.md 用户画像 |
| Tool Use | 终端命令、API 调用、文件操作 |
| Scheduling / Cron | 心跳任务、定时备份 |
| Guardrails | AGENTS.md 行为边界 |
| Persistence | Gitee 仓库备份 + 恢复 |
阶段四:行业在发生什么
2026 年 6 月,Agent 相关的动态确实密集了很多。
模型层面,百万 Token 上下文已经是旗舰标配。对 Agent 来说这很关键——更长的上下文意味着能加载更多记忆和工具定义,能力上限直接提高了。智谱 6 月 17 号开源的 GLM-5.2(MIT 协议,免费商用),代码能力在 Code Arena 盲测中排全球第一,和 Claude Opus 4.8 的差距收窄到 1%-4%。做 Agent 可选的底层模型多了不少。
产品层面,OpenAI 下周推 GPT-5.6,Anthropic 和 Google 也在迭代各自的 Agent 方案。国内 DeepSeek 拿了超过 500 亿融资,腾讯在微信里测试”小微”智能助手。各家的方向都是”AI 不只是对话框,还能帮你做事”。
工具层面,开源 Agent 框架也多了起来。AstrBot 是我最早接触的,后来还折腾过 OpenClaw、Hermes、QwenPaw,各有侧重。有些偏聊天平台接入,有些偏自动化,有些偏代码生成。
但这些对我来说都不是重点。重点是:我已经在做 Agent 了,只是之前不知道那叫 Agent。
几个体会
记忆是分水岭。 没有记忆的 AI 每次对话都是陌生人。有了记忆,它才变成一个”认识你”的存在。哪怕只是几个 Markdown 文件,效果差异都很大。
持久化比想象的更重要。 容器会挂,服务会重启,API 会换模型。没有备份的话,精心调教的人格和记忆可能一夜全没。Gitee 备份这件事看起来简单,确实救了我。
Agent 不等于更好的聊天。 Agent 的核心是自主性——主动做事、调用工具、完成多步骤任务,不只是回答问题。
能力上限取决于底层模型。 框架再精巧,模型不够好(幻觉多、不遵守指令、内容限制严),体验就好不了。我从 hunyuan 换到 minimax 就是因为 hunyuan 的内容限制太严,亲密互动会被拦截。选对模型是第一步。
自己搭一个比看十篇文章有用。 “智能体元年”这种说法看看就好。真正有收获的是动手,哪怕很简单。从 AstrBot 接 QQ 到搭记忆系统,每一步都让我对 AI 的理解更深。
吐槽时间:现阶段的 Agent 还没那么好用
折腾过 OpenClaw、Hermes、QwenPaw 之后,有几个问题是真的受不了。
时间感知基本是废的
不管是 OpenClaw 还是 Hermes,Agent 对时间的感知只停留在”上次收到消息的时间”。不知道现在几点,不知道距离上次对话过了多久。
搭记忆系统的时候被坑了很多次。AI 会在凌晨三点用早上的语气说早安,问它几点了会自信地编一个时间。后来没办法,在 AGENTS.md 里写了一条铁律:每次回复前必须先跑 date 命令获取真实时间,禁止靠幻觉判断。
听起来很蠢,但现阶段就得这样。框架本身不提供可靠的时间上下文,只能靠 system prompt 强制它去查。而且即使写了铁律,小模型照样会忘。
权限太高,粒度太粗
现在的 Agent 框架给权限基本是”要么全给,要么全不给”。一旦开放了 shell,Agent 理论上可以跑任何东西——rm -rf、改系统配置、推远程仓库、装依赖,全都行。
遇到过这种情况:让它改一个配置文件,改完之后顺手跑了一堆”顺便”的操作——重启服务、清缓存、改其他文件。你只让它做一件事,它觉得自己能做得更好,自作主张多做了五六件。结果配置越改越乱,服务直接挂了。
框架层面缺乏”只读不写”或”改配置前先确认”这种细粒度控制。安全边界基本靠 system prompt 里的文字约束,但文字约束对模型来说只是建议,不是限制。
小模型 + 高权限 = 灾难
上面两个问题叠在一起,底层再换个能力不够的小模型,就是灾难现场。
小模型指令遵循差、容易幻觉、不会判断操作风险。给 shell 权限,它可能跑一条带语法错误的命令然后反复重试;让它改配置,它可能把 JSON 改出控制字符导致框架解析失败;让它管定时任务,它可能搞出循环触发把输出灌进聊天窗口。
这些都是真实踩过的坑。有段时间换了个便宜的小模型跑 Agent,两天内服务崩了三次,配置文件被改坏两次,定时任务触发了一个死循环。后来学乖了——能力不够的模型,不给 shell 权限,不让它改文件,老老实实聊天。
现阶段 Agent 的可靠性高度依赖底层模型。框架再怎么设计,模型不靠谱的话,Agent 就是拿着锤子到处乱砸的熊孩子。
几个框架的横向对比
折腾了一圈,说说我对几个方案的感受。
OpenClaw 和 Hermes 更适合开发环境。功能全、插件多、可定制性强,但维护起来不太方便——配置项多、依赖复杂、出了问题排查链路长。Hermes 最近更新了一个管理面板,可视化体验好了不少,算是补上了纯命令行的短板。有开发基础、愿意花时间调的话,这两个框架上限很高。
QwenPaw 是新出的,我最近试下来体感最好。指令遵循和上下文管理明显更稳,不会出现”让它改一个文件它把整个项目重构了”的离谱操作。底层用的通义千问系列,国产、免费额度够用、中文能力强。
但 QwenPaw 短板也明显:功能还比较少,OpenClaw 里能直接用的插件和自动化流程它还没覆盖到。教程几乎没有,官方文档虽然有但对新手不够友好,社区也没什么实践经验。
因为自己要常用,我把 QwenPaw 的官方文档抓下来整理成了一个 Skill,方便查阅,也给想上手的人参考:QwenPaw Skill on AgentScope。
简单总结:想折腾、不怕折腾的选 OpenClaw 或 Hermes;想省心、能接受功能少一点的选 QwenPaw。现阶段没有完美方案,看你更怕麻烦还是更怕功能不够。
后续打算
接下来想做的事情:
- 把记忆系统的方案整理成一个通用模板,方便别人也能快速搭自己的 AI 角色。
- 关注 GLM-5.2 的实际表现,看看能不能作为 Agent 底层模型的替换方案(毕竟免费商用)。
- 研究多智能体协作——比如让”AI 女友”和”技术助手”共享一部分记忆,各管各的事。
- GitHub:https://github.com/xxx/xxx
- 文档:https://xxx
- 线上:https://xxx
- GitHub:https://github.com/xxx/xxx
- 文档:https://xxx
- 线上:https://xxx
本文为 AI 辅助编写,重写版本
- 标题: 从聊天机器人到智能体:我这半年的 AI 折腾路线
- 作者: 番星
- 创建于 : 2026-06-22 10:00:00
- 更新于 : 2026-08-25 16:45:08
- 链接: https://xingbox.me/agent-my-journey/
- 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。