写作

笔记、决策与仍在验证的想法。

记录 Agents、产品判断、Memory、系统,以及如何把新技术真正做成有用产品。

2026

08八月

Agent 自主权的边界

自主权不是一个从低到高的开关,而是一组需要分别授予、验证、限制与撤回的决策权。

13 分钟

Coding Agent 的执行系统

以一次跨越前端、后端与持久化的故障修复为线索,拆解 Coding Agent 如何探索、规划、修改、验证并恢复。

18 分钟

07七月

Context、Memory 与注意力预算

可靠的 Agent Context 需要分开管理 Archive、长期 Memory 与当前工作集,并为每一次信息进入分配有限注意力。

7 分钟

Memory 与产品连续性

Memory 的产品价值体现在连续性、可解释与可修正:系统记得重要的变化,也允许用户摆脱过期的自己。

5 分钟

06六月

生成式 AI 的计费边界

可靠计费依赖于准确区分任务何时被接纳、完成、交付、结算或冲正,而不只是维护一张价目表。

7 分钟

04四月

03三月

01一月

Agent Runtime 设计笔记

原生 Tool Calling 让 Oracle 的决策更干净,但可靠性仍然取决于状态、继承、验证与恢复。

7 分钟

2025

11十一月

Squad 失败复盘

Squad 可以运行并重规划数月,却仍然无法评估今天的行动在长期视角下是否正确。

7 分钟

08八月

长任务 Agent 与持久状态

模型的推理发生在一次调用里,但真实工作跨越时间。可靠的 Agent 必须能够暂停、恢复、被看见,并把完成变成交付。

6 分钟

05五月

2024

12十二月

怎样把网页真正交给 AI

URL 不是内容,复制粘贴也不是答案。要让网页成为 AI 可以使用的材料,中间还有一段很容易被忽略的路。

7 分钟