Manus task envelope、临时 Sandbox VM、browser files code software 流水线、artifact 验收、Wide Research 与本地 Browser Operator 边界

给 Agent 一台电脑之后:Manus 如何把回复变成交付物

聊天产品最容易展示的完成标志,是最后一条 assistant message。 任务产品最危险的完成标志,也是最后一条 assistant message。 因为“已完成”可能只表示 Agent 停止运行。用户真正要验收的,也许是一份引用可靠的报告、一张字段齐全的数据表、一个能打开的网站、一段可以维护的代码,或一个下周仍在运行的 bot。只要价值单位从 reply 变成 work product,完成状态就必须离开聊天气泡,落到 artifact 和外部世界。 ...

2026 年 8 月 7 日 · 14 分钟 · 6774 字 · Xinwei Xiong, Me
Codex 多 Surface、App Server 公共契约、Submission 与 Event 双总线以及 approval 和 sandbox 副作用闸门

Codex 的协议化内核:第二个 Surface 不该复制第一个 Agent

第二个界面,往往才是一次 Agent 架构审查的开始。 只有 CLI 时,输入框可以直接调用 loop,命令结果可以直接刷进终端,审批状态也可以藏在某个局部变量里。等 IDE 侧栏、桌面端、自动化脚本和第三方客户端陆续出现,同一份内部状态会被复制成四套近似实现:它们对“当前任务是否结束”“这次 patch 属于哪个 turn”“批准以后还受不受 sandbox 限制”给出不同答案。 ...

2026 年 8 月 7 日 · 13 分钟 · 6305 字 · Xinwei Xiong, Me
Pi 最小 Agent kernel、可拆卸 extension 轨道、provider 与 host OS 信任边界以及下方 JSONL session tree

Pi 的减法:最小 Agent Kernel 保留什么,责任又去了哪里

Pi 默认只把四个工具交给模型:read、bash、edit、write。 它没有内置 Plan Mode、Todo、MCP、subagent、permission popup 或 background bash。读到这里,很容易把 Pi 写成一篇极简主义赞歌:四个工具足够,复杂框架都可以删掉。 ...

2026 年 8 月 7 日 · 17 分钟 · 8260 字 · Xinwei Xiong, Me
Claude Code 中模糊意图经过上下文、Agent loop、工具提案、权限、沙箱、工作树和测试,成为受约束仓库修改的控制河流

Claude Code 的扩展语法:一条仓库修改怎样逐级获得控制

把“永远不要修改 .env”写进 CLAUDE.md,这条要求会进入 Claude 的上下文。它会影响模型的选择,却没有在文件系统前竖起一道墙。 同一句话若进入 PreToolUse Hook、permission deny rule 或 sandbox 文件规则,语义已经变了:它开始决定一次工具调用能否发生,或者一个 Bash 子进程实际能碰到什么。 ...

2026 年 8 月 7 日 · 13 分钟 · 6056 字 · Xinwei Xiong, Me
信号卡、状态账本、受限判断舱、人工审批杆和结果回流组成一台增长控制台

n8n 入门:给超级个体搭一条会被结果改写的增长流水线

先别连接邮箱、CRM 或社媒账号。打开一张空白的 n8n 画布,只放三个节点: Manual Trigger → Edit Fields → IF 在 Edit Fields 里写入一条假的内容信号,让 IF 根据证据数量把它送进 True 或 False 分支。先把 evidence_count 设为 3 执行一次,再改成 1 执行一次。两条路线都跑对以后,你已经碰到了工作流自动化最重要的五件事:触发、结构化数据、规则、分支和执行记录。 ...

2026 年 8 月 7 日 · 11 分钟 · 5284 字 · Xinwei Xiong, Me
多人共享的组织级 Agent 调度台、权限柜、记忆库与隔离执行空间

Claude Tag 深度拆解:Slack 里的共享 AI,正在长成组织级 Agent 运行时

如果把 Claude Tag 只理解为 Slack 机器人,会错过它最重要的产品变化。它把频道变成了一个可授权、可记忆、可持续运行的 Agent 空间:团队共享同一个执行者,任务在 Anthropic 托管的线程级沙箱中异步完成,外部凭证由 Agent Proxy 在边界注入,结果回到公开线程并留下可追溯记录。Claude Tag 官方文档 已经把这些机制写得相当具体。 ...

2026 年 8 月 5 日 · 20 分钟 · 9709 字 · Xinwei Xiong, Me
精密木桥从绘图桌伸入钢制承重测试架,重物悬在桥面上方

我不缺执行力,我缺一个有权否决我的战场

2026 年初,我的 GitHub 贡献图 曾连续数周接近空白;几个月后,同一张图上出现了单周数百次 contributions。到了七月,博客发布了 55 篇中文文章 ,GitHub 的 contribution calendar 记录了 733 次 contributions。 ...

2026 年 8 月 3 日 · 5 分钟 · 2179 字 · Xinwei Xiong, Me
散乱木片依次穿过三道透明取景框,被分组后越过边界门进入测试棋盘,结果沿回路返回起点

我知道什么是 Agent,却说不出它的定义

一次交流里,我卡在一句看似简单的话上:“我知道 Agent 的体感边界,但是不知道 Agent 具体的定义怎么样说。” 我能判断一个固定路径的 workflow 不太像 Agent,也能看出一个会根据工具结果改计划、必要时暂停或移交的系统更像 Agent。可当对方等我给出一句没有漏洞的定义时,我发现脑中的东西不是一句话。它更像许多正例、反例、相邻概念和行动后果叠出来的判别器。 ...

2026 年 8 月 2 日 · 10 分钟 · 4669 字 · Xinwei Xiong, Me
一本持续增补的旧书长成可检索的文件卡与向不同方向扎根的仙人球

如果蒙田有一个 AI:我为什么把 DayPage 做成一场自我实验

如果蒙田也有一个 AI,会发生什么? 我是在每天使用 DayPage、看着个人 vault 里积累到约 250 天 Markdown 以后,才真正问出这个问题。过去越来越不容易丢失:AI 可以找回旧句、并排不同年份的判断、指出我忘记的矛盾。与此同时,“这些记录说明我是怎样的人”也越来越容易被它抢先回答。 ...

2026 年 8 月 2 日 · 7 分钟 · 3085 字 · Xinwei Xiong, Me
固定需求轴与被重新连接的行业工作流卡片

常识不是本质:AI 时代如何从需求、约束与稀缺性重构行业

“常识就是本质吗?”我最近连续拿几个行业做推演时,最先卡在了这个问题上。看完 22 家前沿 AI 团队、70 余位公开人物的作品链后,我反复遇到几种动作:围绕一个长期命题积累,先写清怎样才算合格,让论文、代码和产品连续留下作品,再把生产失败送回下一轮。可这些动作仍没有回答:面对传统行业,我从哪里开始判断,才能避免拿着新技术寻找伪需求? ...

2026 年 8 月 1 日 · 15 分钟 · 7068 字 · Xinwei Xiong, Me
2026年7月的一些思考笔记:工程、内容与现金流

2026年7月的一些思考笔记:工程、内容与现金流

本月导航 先读长文:本篇正文 9 节。 本月 17 条原始记录,按 7 个大方向归档: 日常与其他 · 6 条 AI 与 Agent 系统 · 4 条 自我认知与心理 · 2 条 内容、创作与记录 · 2 条 商业、投资与职业 · 1 条 旅行、地理与城市 · 1 条 阅读、思想与历史 · 1 条 七月大部分时间,我在深圳,也在广东其他城市短暂停了几天。 ...

2026 年 8 月 1 日 · 42 分钟 · 20581 字 · Xinwei Xiong, Me
第二大脑在保存记忆的同时,让不同选择逐渐显出一条现实路径

第二大脑保存的,是一个人的决策函数

我原本只是让第二大脑整理一位朋友的思考。 它把零散记录按时间、主题和因果重新排好,试着解释她怎样看待工作、金钱与自由。几千字以后,我盯着那份人物模型,忽然发现它最清楚地照见的并不是她。 ...

2026 年 7 月 31 日 · 9 分钟 · 4490 字 · Xinwei Xiong, Me
无限生成的图像方格消融进一段有身体代价的真实山水经历

当生成变得无限,真实经历开始升值

本文是一场思想实验式模拟访谈。受访者由田野人类学与纪录片实践视角组合而成,不代表任何真实人物的原话。 我做 AI,却总被 AI 之外的生活打动。 老挝溶洞里的黑,摩托摔倒后伤口的刺痛,湄公河边的风,一个陌生姐姐从眼睛里读出故事,四千美岛走路代替骑车后被拉长的时间——这些经验没有模型效率,也无法一键复现。 ...

2026 年 7 月 31 日 · 5 分钟 · 2494 字 · Xinwei Xiong, Me
分层记忆系统让活跃节点升温、旧信息沉降并保留审计轨迹

AI 时代,遗忘比记忆更难:一个活系统为什么必须会放下

本文是一场思想实验式模拟访谈。受访者由认知神经科学与 AI 记忆系统工程视角组合而成,不代表任何真实专家的原话。 2026 年 3 月,我在一条笔记里写:AI 时代,也许忘记比记忆更重要。 ...

2026 年 7 月 31 日 · 10 分钟 · 4511 字 · Xinwei Xiong, Me
笔记本与剪刀把完整日落裁成一张张记录卡片

记录不是镜子,是剪刀:你用什么工具,最后就会成为什么样的人

本文是一场思想实验式模拟访谈。受访者由认知科学、档案学和产品设计视角组合而成,不代表任何真实专家的原话。 2026 年 5 月,我停用了 flomo。 那一个月没有每日提醒,没有“今天还没记”的轻微欠债感,也没有把每个念头迅速变成一条卡片。奇怪的是,生活没有因此变薄。相反,老挝的城市、溶洞、摔伤、陌生人和酒吧在月末汇成了一次比碎片更完整的自我读取。 ...

2026 年 7 月 31 日 · 5 分钟 · 2266 字 · Xinwei Xiong, Me
多台机器生产空白纸张,最终汇入一道狭窄的审查门

AI 解决问题以后,问题会搬到哪里

这是「与现实对账」选集的第六篇。上一篇把快反馈与慢结果分开;这一篇讨论技术进步之后更容易被忽略的问题:旧瓶颈消失时,新的瓶颈会在哪里出现? 每一种新工具刚出现时,人们最容易想象它消灭了什么。 ...

2026 年 7 月 26 日 · 8 分钟 · 3638 字 · Xinwei Xiong, Me
Open Design 作为 Coding Agent 的四平面设计工作台

Open Design 0.16.1:给 Coding Agent 一张可复用的设计工作台

Open Design 很容易被名字带偏。这个词也指更早的开放式设计运动,但本文讨论的是 nexu-io/open-design :一个把 Coding Agent 组织成设计生产系统的开源工作区。 它不是模型,也不只是一个出图工具。更准确地说,它是一套 harness——给能力加上边界、流程与反馈回路的工作台。它为 Agent 准备可控的词汇、可复用的工作方法、视觉约束、工件迭代环,以及检查结果的地方。模型和操作者依然决定质量上限,Open Design 改善的是从意图走到成品的那段路。 ...

2026 年 7 月 22 日 · 8 分钟 · 3732 字 · Xinwei Xiong, Me
Claude Code 十项实战配置:验证、权限、上下文、循环与并行代理

Claude Code 实战手册:从验证闭环到并行代理的 10 个配置

先把“技巧清单”放到一边 我最初想写一篇 Boris Cherny 用法合集。问题是,社交媒体里的经验会随模型、版本和套餐变化;粉丝站又常把个人观点、尚未公开的功能和统计数字混在一起。今天看起来锋利的结论,几个月后可能只剩一个漂亮的句子。 ...

2026 年 7 月 20 日 · 11 分钟 · 5106 字 · Xinwei Xiong
一张象征验证器、状态与安全自动化的安静控制台

独立开发者的 Loop Engineering:验证器、状态与安全自动化

用得越熟,为什么反而越累 先说一个我自己撞了很久才想明白的怪现象。 刚开始用 Claude Code 的时候,效率提升是肉眼可见的:一个下午干完过去两天的活。用熟之后,效率还在涨,但一天结束时的疲惫感也在涨——因为我整天都在做同一件事:看它跑完、判断对不对、想下一句该说什么、再敲回车。 ...

2026 年 7 月 20 日 · 27 分钟 · 13102 字 · Xinwei Xiong, Me
独立创作者从拍摄到多平台发布的 AI 视频剪辑流水线

独立创作者的 AI 视频剪辑流水线:拍摄、粗剪与多平台发布

去年冬天有一次我算了一笔很难看的账。 那天我在一家咖啡馆待了一整个下午,边写代码边拍素材,手机和录屏加起来大概四十分钟。晚上回去开始剪,凌晨一点半导出,成片五十八秒。 ...

2026 年 7 月 19 日 · 21 分钟 · 10135 字 · Xinwei Xiong, Me
当东西人人做得出来,「这是他做的」就成了信号

当东西人人做得出来,「这是他做的」就成了信号

同一个东西,换个名字,分数就变了 有一件事我观察了挺久,一直没找到合适的地方写。 在同一个产品社区里,经常会出现两个功能几乎重合的小工具。一个发出来石沉大海,另一个被反复转发、被认真提问。你去看两个产品页,做工差不多,定价差不多,落地页甚至用了同一个模板。真正不一样的地方在发布者名字后面那一行小字——「某某项目的维护者」「写了三年 xx 的人」。 ...

2026 年 7 月 19 日 · 23 分钟 · 11052 字 · Xinwei Xiong
独立开发者的分发策略:产品可以复制,读者关系需要长期积累

独立开发者的分发策略:产品能被复制,读者关系不能

我在这句话上浪费了好几年 「产品做得足够好,自然会有人来。」 这句话我信了很多年。它符合工程师的世界观:代码是可验证的,性能是可测量的,好和坏之间有客观差别。既然有客观差别,那么好的东西胜出就是迟早的事——市场是有效的,只是需要一点时间。 ...

2026 年 7 月 19 日 · 19 分钟 · 9266 字 · Xinwei Xiong, Me
AI 提需求不要钱,这才是最危险的地方

AI 提需求不要钱,这才是最危险的地方

一个早上,和三件不该存在的东西 有一天早上我起来,泡咖啡,打开笔记本,看到夜里跑的几个 agent 都停在了完成状态:一个给我的小工具加了完整的多语言支持,中英日三套文案,抽了 i18n 层;一个给博客做了阅读进度统计;一个把我半年前写的 CLI 重构成了插件架构。代码都很干净,测试都是绿的。 ...

2026 年 7 月 19 日 · 24 分钟 · 11878 字 · Xinwei Xiong
夜里跑十个 agent,早上收十个 PR,然后我卡住了

夜里跑十个 agent,早上收十个 PR,然后我卡住了

这是《超级个体的装备栈》系列的第二篇。如果你还没读过总纲 ,建议先读那篇——这篇的所有判断都建立在那篇提出的标准之上:一层装备的进步,是只帮你,还是同时帮你所有对手。 ...

2026 年 7 月 19 日 · 26 分钟 · 12650 字 · Xinwei Xiong
超级个体四层装备栈,从 AI 生产工具向判断、分发与声誉逐层上升

超级个体的四层 AI 装备栈:什么才会真正复利

第十五份清单,让我换了一个问题 半年里,我认真读过二三十份「AI 时代超级个体装备清单」。读到第十五份左右时,一件事越来越扎眼:这些清单彼此之间的差异,远小于它们各自许诺的竞争优势。 ...

2026 年 7 月 19 日 · 10 分钟 · 4623 字 · Xinwei Xiong, Me
你的 Mac 上有几套工具在打架?我设计了一个开发机体检 Skill

你的 Mac 上有几套工具在打架?我设计了一个开发机体检 Skill

我决定做一个面向程序员的开发机体检 skill,代号 devbox-doctor。它只读扫描你的 Mac,把应用、包管理器、配置接管点、常驻资源和可能的卸载残留整理成事实;模型只负责解释证据并提出下一步,不能把“看起来像”变成删除命令。最终交付是一份能复核、能降级、能说明自己哪里不知道的体检报告。这篇文章记录它的设计,也记录几处最容易写得漂亮、做得危险的地方。 ...

2026 年 7 月 18 日 · 12 分钟 · 5938 字 · Xinwei Xiong, Me
Agent Skill 与 SKILL.md 设计:我拆了一个敢删文件的插件

Agent Skill 与 SKILL.md 设计:我拆了一个敢删文件的插件

一套有价值的 Skill,核心不在 prompt 多精妙,而在三件事划分得多干净:确定性的工作交给代码,语义判断交给模型,执行确认交还给人,再用结构化契约把三者缝起来。这个结论来自我最近拆解的一个存储清理 Skill。删文件是 Agent 的高风险能力,而它能让我从「本能警惕」走到「愿意确认」,靠的是设计,不是信任。 ...

2026 年 7 月 18 日 · 9 分钟 · 4200 字 · Xinwei Xiong, Me
连接证据卡、可执行工作流、内容平台与反馈回路的私有 AI 知识兵工厂

搭建 AI 知识库:从零散笔记到可执行工作流

框架立完之后,我发现自己没有「第一现场」 「从信息到创作」五篇写完,框架是立住了:信息采集降噪,记录沉淀半成品,知识结构化成能力,创作面向受众重组。但写完第三层·知识 里那句「知识库是你和 AI 共用的第一现场」之后,我一直有点心虚—— ...

2026 年 7 月 17 日 · 9 分钟 · 4412 字 · Xinwei Xiong, Me
一个人带一队 Agent,把 120 多篇文章的博客重新组装了一遍

一个人带一队 Agent,把 120 多篇文章的博客重新组装了一遍

先说这件事本身 把一座写了四年、积累了 120 多篇文章的博客,从内容架构到运营方式全部重新组装一遍,需要多大的团队? 我今年上半年给出了自己的答案:一个人,带一队分工明确的 Agent。 这里的"一队"不是一个固定数字,也不是七八个永远在线的数字员工;它是我对 Claude Code、Codex、GitHub Actions 中的 Claude 任务,以及临时评审会话的统称。截至 2026 年 7 月,仓库里能数清的是七个 Claude skills、四条以 seo- 命名的工作流和若干按需启动的会话。人负责判断、边界和签字,Agent 承担范围明确、可以验收的执行。新版就是你现在看到的 cubxxw.com ——它不只是一次改版,而是把"博客"这个东西从一个静态网站,改造成了一个会生成日报、准备修复 PR、对外提供检索接口的系统。 ...

2026 年 7 月 17 日 · 17 分钟 · 8095 字 · Xinwei Xiong, Me
2026 AI Agent 红海与蓝海:垂直工作流、支付协议与责任护城河

2026 AI Agent 红海与蓝海:垂直工作流、支付协议与责任护城河

假如今天你要给自己选一个 AI Agent 的方向下注,你最该先问的问题是什么? 多数人问的是"这个能不能做出来"。但在 2026 年,许多应用的首要瓶颈已不再是模型能力,做出 demo 也不再稀缺。真正该问的,是另一个更冷的问题:“为什么这么大的机会,别人还没把它做死?” ...

2026 年 7 月 15 日 · 22 分钟 · 10717 字 · Xinwei Xiong, Me