Agent 系统设计的五个所有权问题、从意图到副作用与证据的控制权宪法之河,以及六种最小成立形态的决策图

Agent 不是一种产品:十套系统如何重新分配控制权、状态、身份与副作用

系统 A 有十二个 Agent、长期记忆、云端电脑、事件日志和自动恢复。 系统 B 只做一次 document → structured candidate,把结果放进表单,等人核对原件后再保存。 ...

2026 年 8 月 7 日 · 14 分钟 · 6611 字 · Xinwei Xiong, Me
OpenHands V1 从无状态 Agent step、追加式 typed event log、base state、派生 view 到 local/remote runtime 与副作用恢复协议的架构图

Conversation as Database:OpenHands 的无状态 Agent 与事件运行时

凌晨两点,Agent 准备给一个 GitHub issue 添加“修复已完成”的标签。 ActionEvent 已经写进日志。GitHub API 也返回了 200。就在 SDK 把结果包装成 ObservationEvent 之前,进程崩溃。 重启以后,历史里只剩一条没有 observation 的 action。 ...

2026 年 8 月 7 日 · 14 分钟 · 7007 字 · Xinwei Xiong, Me
TradingAgents 从时间截点证据、串行分析师、牛熊法庭、风险声部到组合经理研究输出的证据法庭架构图

多 Agent 辩论真的增加了信息吗:TradingAgents 的组织图与相关性风险

法庭里坐着九位证人。 四位负责市场、情绪、新闻与基本面;两位分别坚持看多和看空;三位从激进、中性与保守的风险偏好发言。最后还有研究经理、交易员和组合经理逐层裁决。 ...

2026 年 8 月 7 日 · 12 分钟 · 6012 字 · Xinwei Xiong, Me
OpenMontage 由 instruction 控制带、canonical artifact 胶片河和工具检查点验证带组成的视频生产架构图

Instructions as Code:OpenMontage 如何用工件契约编排视频生产

渲染命令退出码是 0。 MP4 文件存在,容器可被 ffprobe 读取,render_report 也符合 JSON Schema。流水线甚至可能给出 pass,建议把成片交给用户。 ...

2026 年 8 月 7 日 · 12 分钟 · 5782 字 · Xinwei Xiong, Me
OpenClaw 从互联网渠道经过常驻 Gateway、确定性 bindings、session key、per-agent enclave 到设备节点与外部副作用的路由图

OpenClaw 的常驻网关:连续性不是把所有消息塞进同一会话

假设同一家公司有两个 Telegram bot:一个服务欧洲客户,一个服务美国客户。两个 bot 都把消息交给同一个 support agent,session 隔离策略写成了 per-channel-peer。 某个平台用户 ID 恰好同时出现在两个账号里。 ...

2026 年 8 月 7 日 · 15 分钟 · 7435 字 · Xinwei Xiong, Me
n8n 确定性 workflow 主干、受限 Agent 支线、人工与幂等闸门、外部回执对账以及 Redis worker Postgres queue-mode 车场

n8n 的确定性外骨骼:Queue、Worker 与副作用从不承诺 Exactly-Once

前一篇 n8n 入门 已经从 Manual Trigger → Edit Fields → IF 开始,讲过 Growth OS、受限 Agent、人工审批、operation ledger、结果回流和 alternatives。 ...

2026 年 8 月 7 日 · 13 分钟 · 6240 字 · Xinwei Xiong, Me
Manus task envelope、临时 Sandbox VM、browser files code software 流水线、artifact 验收、Wide Research 与本地 Browser Operator 边界

给 Agent 一台电脑之后:Manus 如何把回复变成交付物

聊天产品最容易展示的完成标志,是最后一条 assistant message。 任务产品最危险的完成标志,也是最后一条 assistant message。 因为“已完成”可能只表示 Agent 停止运行。用户真正要验收的,也许是一份引用可靠的报告、一张字段齐全的数据表、一个能打开的网站、一段可以维护的代码,或一个下周仍在运行的 bot。只要价值单位从 reply 变成 work product,完成状态就必须离开聊天气泡,落到 artifact 和外部世界。 ...

2026 年 8 月 7 日 · 14 分钟 · 6774 字 · Xinwei Xiong, Me
Codex 多 Surface、App Server 公共契约、Submission 与 Event 双总线以及 approval 和 sandbox 副作用闸门

Codex 的协议化内核:第二个 Surface 不该复制第一个 Agent

第二个界面,往往才是一次 Agent 架构审查的开始。 只有 CLI 时,输入框可以直接调用 loop,命令结果可以直接刷进终端,审批状态也可以藏在某个局部变量里。等 IDE 侧栏、桌面端、自动化脚本和第三方客户端陆续出现,同一份内部状态会被复制成四套近似实现:它们对“当前任务是否结束”“这次 patch 属于哪个 turn”“批准以后还受不受 sandbox 限制”给出不同答案。 ...

2026 年 8 月 7 日 · 13 分钟 · 6305 字 · Xinwei Xiong, Me
Pi 最小 Agent kernel、可拆卸 extension 轨道、provider 与 host OS 信任边界以及下方 JSONL session tree

Pi 的减法:最小 Agent Kernel 保留什么,责任又去了哪里

Pi 默认只把四个工具交给模型:read、bash、edit、write。 它没有内置 Plan Mode、Todo、MCP、subagent、permission popup 或 background bash。读到这里,很容易把 Pi 写成一篇极简主义赞歌:四个工具足够,复杂框架都可以删掉。 ...

2026 年 8 月 7 日 · 14 分钟 · 6646 字 · Xinwei Xiong, Me
Claude Code 中模糊意图经过上下文、Agent loop、工具提案、权限、沙箱、工作树和测试,成为受约束仓库修改的控制河流

Claude Code 的扩展语法:一条仓库修改怎样逐级获得控制

把“永远不要修改 .env”写进 CLAUDE.md,这条要求会进入 Claude 的上下文。它会影响模型的选择,却没有在文件系统前竖起一道墙。 同一句话若进入 PreToolUse Hook、permission deny rule 或 sandbox 文件规则,语义已经变了:它开始决定一次工具调用能否发生,或者一个 Bash 子进程实际能碰到什么。 ...

2026 年 8 月 7 日 · 13 分钟 · 6056 字 · Xinwei Xiong, Me
散乱木片依次穿过三道透明取景框,被分组后越过边界门进入测试棋盘,结果沿回路返回起点

我知道什么是 Agent,却说不出它的定义

一次交流里,我卡在一句看似简单的话上:“我知道 Agent 的体感边界,但是不知道 Agent 具体的定义怎么样说。” 我能判断一个固定路径的 workflow 不太像 Agent,也能看出一个会根据工具结果改计划、必要时暂停或移交的系统更像 Agent。可当对方等我给出一句没有漏洞的定义时,我发现脑中的东西不是一句话。它更像许多正例、反例、相邻概念和行动后果叠出来的判别器。 ...

2026 年 8 月 2 日 · 10 分钟 · 4669 字 · Xinwei Xiong, Me
固定需求轴与被重新连接的行业工作流卡片

常识不是本质:AI 时代如何从需求、约束与稀缺性重构行业

“常识就是本质吗?”我最近连续拿几个行业做推演时,最先卡在了这个问题上。看完 22 家前沿 AI 团队、70 余位公开人物的作品链后,我反复遇到几种动作:围绕一个长期命题积累,先写清怎样才算合格,让论文、代码和产品连续留下作品,再把生产失败送回下一轮。可这些动作仍没有回答:面对传统行业,我从哪里开始判断,才能避免拿着新技术寻找伪需求? ...

2026 年 8 月 1 日 · 15 分钟 · 7068 字 · Xinwei Xiong, Me
Claude Code 十项实战配置:验证、权限、上下文、循环与并行代理

Claude Code 实战手册:从验证闭环到并行代理的 10 个配置

先把“技巧清单”放到一边 我最初想写一篇 Boris Cherny 用法合集。问题是,社交媒体里的经验会随模型、版本和套餐变化;粉丝站又常把个人观点、尚未公开的功能和统计数字混在一起。今天看起来锋利的结论,几个月后可能只剩一个漂亮的句子。 ...

2026 年 7 月 20 日 · 11 分钟 · 5106 字 · Xinwei Xiong
一张象征验证器、状态与安全自动化的安静控制台

独立开发者的 Loop Engineering:验证器、状态与安全自动化

用得越熟,为什么反而越累 先说一个我自己撞了很久才想明白的怪现象。 刚开始用 Claude Code 的时候,效率提升是肉眼可见的:一个下午干完过去两天的活。用熟之后,效率还在涨,但一天结束时的疲惫感也在涨——因为我整天都在做同一件事:看它跑完、判断对不对、想下一句该说什么、再敲回车。 ...

2026 年 7 月 20 日 · 24 分钟 · 11896 字 · Xinwei Xiong, Me
独立创作者从拍摄到多平台发布的 AI 视频剪辑流水线

独立创作者的 AI 视频剪辑流水线:拍摄、粗剪与多平台发布

去年冬天有一次我算了一笔很难看的账。 那天我在一家咖啡馆待了一整个下午,边写代码边拍素材,手机和录屏加起来大概四十分钟。晚上回去开始剪,凌晨一点半导出,成片五十八秒。 ...

2026 年 7 月 19 日 · 21 分钟 · 10135 字 · Xinwei Xiong, Me
夜里跑十个 agent,早上收十个 PR,然后我卡住了

夜里跑十个 agent,早上收十个 PR,然后我卡住了

这是《超级个体的装备栈》系列的第二篇。如果你还没读过总纲 ,建议先读那篇——这篇的所有判断都建立在那篇提出的标准之上:一层装备的进步,是只帮你,还是同时帮你所有对手。 ...

2026 年 7 月 19 日 · 26 分钟 · 12650 字 · Xinwei Xiong
一个人带一队 Agent,把 120 多篇文章的博客重新组装了一遍

一个人带一队 Agent,把 120 多篇文章的博客重新组装了一遍

先说这件事本身 把一座写了四年、积累了 120 多篇文章的博客,从内容架构到运营方式全部重新组装一遍,需要多大的团队? 我今年上半年给出了自己的答案:一个人,带一队分工明确的 Agent。 这里的"一队"不是一个固定数字,也不是七八个永远在线的数字员工;它是我对 Claude Code、Codex、GitHub Actions 中的 Claude 任务,以及临时评审会话的统称。截至 2026 年 7 月,仓库里能数清的是七个 Claude skills、四条以 seo- 命名的工作流和若干按需启动的会话。人负责判断、边界和签字,Agent 承担范围明确、可以验收的执行。新版就是你现在看到的 cubxxw.com ——它不只是一次改版,而是把"博客"这个东西从一个静态网站,改造成了一个会生成日报、准备修复 PR、对外提供检索接口的系统。 ...

2026 年 7 月 17 日 · 17 分钟 · 8095 字 · Xinwei Xiong, Me
夜间无人值守 Agent 工作流与晨间人工审批闸口

如何建立对无人值守 AI Agent 的真实信任

假设你现在真的有一个 agent,能把一件事从头做到尾——拉数据、写代码、跑测试、发 PR、改文档,一条龙。它不需要你在旁边一句一句喂提示词。你晚上把任务丢给它,去睡觉。 ...

2026 年 7 月 15 日 · 21 分钟 · 10432 字 · Xinwei Xiong, Me
当 AI Agent 开始反过来提示你,真正改变了什么

当 AI Agent 开始反过来提示你,真正改变了什么

一个反直觉的信号:它开始反过来提示你 假设有一天,你打开工作台,Agent 没有等你输入下一条命令,而是先说: 我注意到昨天那份方案的第三节还没有收尾。我按你上周的口径起了一个草稿,现在要看吗? ...

2026 年 7 月 15 日 · 10 分钟 · 4637 字 · Xinwei Xiong, Me
AI 工作流质量门禁的四道工程纪律

AI 工作流质量门禁:把软件工程的纪律搬进个人系统

「能跑」不等于「可靠」 大多数人搭个人 AI 系统时,第一条验收标准是:能不能跑? 能写出一篇文章,能改完一段代码,能把十页资料压成一页,看起来就算完成了。但用久以后,真正折磨人的是无声的错误:结构工整,语气笃定,结论却悄悄偏离了事实。 ...

2026 年 7 月 11 日 · 7 分钟 · 3075 字 · Xinwei Xiong, Me
open-lovable 从网页抓取到代码生成与双沙箱预览的源码架构

open-lovable 源码拆解:Agentic Search、文本协议与双沙箱

open-lovable 看起来像一句很短的产品承诺:给它一个网址,得到一个可继续修改的 React 应用。真正值得读的却不是生成结果,而是它怎样把抓取、模型输出和不可信代码执行接成一条可控链路。 ...

2026 年 6 月 29 日 · 8 分钟 · 3683 字 · Xinwei Xiong, Me
超级个体的栈:AI 原生 Solo Builder 的产品方向与运营全图

超级个体的栈:2026 年 AI 原生 Solo Builder 的产品方向与运营全图

「Software is eating the world.」 —— Marc Andreessen, 2011 「Now, AI is eating software, and the question for the rest of us is: what’s left for one human, alone, in front of a screen?」 —— 我于 2026 年的某个凌晨,在台灯下问自己。 ...

2026 年 6 月 24 日 · 18 分钟 · 8927 字 · Xinwei Xiong, Me
一张技术示意图,中心是一个小小的 agent loop,外面一圈一圈包裹着编排、上下文、记忆、工具、可靠性、评估、成本、治理八根支柱

Agent Engineering 全景地图:98.4% 只是 Harness 的叙事锚点

「Agent loop 是 10 行代码,Agent engineering 是 10 万行代码。」 这句话不是代码审计结论,更像一把拆系统的刀。它戳破了一个常见错觉:把 prompt 写好、把 LLM API 调通,只能证明 loop 能转;要让系统在无人值守时仍可恢复、可追踪、可约束,主要工作在 loop 外。 ...

2026 年 6 月 17 日 · 25 分钟 · 12134 字 · Xinwei Xiong, Me
Agent 身份连续性的文件、记忆、运行环境与评测结构

Agent 的自我:从洛克到 OpenClaw

关于 AI 智能体身份连续性的哲学边界与工程实践 引言:先把“身份”降到工程可讨论的尺度 Agent 失忆,最先伤害的不是拟人感,而是合作成本。 一次会话里表现出色,并不等于下次还能沿用同一套判断。用户要重新说明偏好,团队要重新交代约束,系统也很难解释某个决定从哪里来。长期合作所依赖的信任,恰好建立在这些看似琐碎的连续性上:它记得什么,忘掉什么,为什么改变,以及谁批准了改变。 ...

2026 年 4 月 5 日 · 14 分钟 · 6690 字 · Xinwei Xiong, Me