做 AI Agent 系统的架构和落地

一个人从产品设计写到生产运维。这里记录工程里踩过的坑和想清楚的事,只写自己做过的。

Agent 工程 · LLM 应用生产化 · 分布式与一致性 · 疑难问题排查

今年关于多 Agent 的证据,和直觉是反的

「多个 agent 协作更强」听起来天经地义。但把 2025–2026 做过这件事的团队和论文摊开看,方向几乎一致地在泼冷水 —— 而且泼的不是模型能力,是组织设计。这篇整理五份证据,附我自己的两条判断。

2026年8月20日 · 3 分钟 · Alex

让 Agent 自己干活,但我不失控:一套半自主工作循环的完整设计

我的时间被会议切碎,拿到任务没时间从零想,但决策权又不能让渡。这套循环解决的是这个矛盾:agent 承担理解成本,我只保留判断。文章给出完整设计——队列机制、定时调度、多 agent 规划、文件分层,以及三次被自己系统打脸的实证。

2026年8月19日 · 6 分钟 · Alex

Agent 写文件,用户改数据库:没有事务的那一半系统

传统 CRUD 只有一个写入方。Agent 系统有两个 —— agent 直接写文件,用户通过页面写数据库,中间没有事务。这不是设计失误,是架构的直接后果。

2026年8月13日 · 3 分钟 · Alex

给 Agent 开权限:身份不能进模型的上下文

选型问题不是「用 skill 还是 MCP」,而是「谁能保证边界」。核心原则只有一条:身份走带外通道,不进模型上下文。

2026年8月12日 · 2 分钟 · Alex

我用 openpyxl 填了个 Excel,交付出去的是个残件

openpyxl 保存 xlsx 时会静默丢掉图形、表单控件和打印设置,而且它丢的恰好是你不会去检查的那部分。

2026年8月11日 · 2 分钟 · Alex