跳到正文

Tag archive

#Agent

13 篇 · 按时间倒序

2026-08-14

进程挂了 resume 回来,agent 却僵住了:log 才是 agent 本体

Claude Code 的进程挂掉后,resume 找回了对话,却丢了待批准的权限请求。要让 agent 真正恢复,持久化的不能只是一份 transcript,还要包括可重放的事件、工作区和副作用状态。
2026-08-13

DeepSeek Harness:我最想抄走的,不是它的插件系统

DeepSeek Harness 把主循环也做成插件,但我更想抄走“模型可见即有日志”这条规则。本文沿开发笔记还原它的取舍,以及它离日常工具还有多远。
2026-08-12

Agent 让每个人都有了翻译器,但团队不再说同一种语言

Agent 能解释旧代码,却补不回当初的取舍。一次看不懂旧模块的经历,让我决定把困在 session 里的设计理由带回代码库。
2026-08-10

给 App 加个聊天框,不叫 Agent-first

Agent-first 的关键不是在 App 里塞聊天框,而是让 UI、Agent 与 MCP 共用同一套业务 action。先改一个高频动作,再决定入口长什么样。
2026-08-04

AI 五分钟解了你一周的 bug,然后你不开心了

Fable 五分钟用 dyld interpose 复现了一周的 bug,顺手修了潜伏七年的缺陷。编程的"施法乐趣"被剥夺了——但被剥夺的,恰恰是效率的敌人。
2026-08-03

Agent 跑得越快,越要提前告诉它什么时候停

Agent 长任务除了完成目标,还要写明三类停点:连续尝试无改善、缺少关键事实、即将越过范围。停下汇报,比继续猜更省时间。
2026-07-16

部署完就再没看过日志?我让 Agent 每天替我巡一遍 Cloudflare

Cloudflare 日志没人看,我给 Agent 配了每日巡检:查询过去 24 小时、对比基线、去重后开 issue。适合 loop 的任务,关键是边界清楚、结果容易核对。
2026-07-13

Agent 写完前端,我要求它先自己点一遍

前端改完别急着接手。把浏览器自检写进 Definition of Done,让 Agent 先走核心路径、查 console、贴截图;人只接手最后的体验判断。
2026-07-02

多数人不判断 agent,只是在吸收它的结论

判断力不是天赋,是可练的肌肉,练法就是“预测—对账”。派活前先写下你赌 agent 会怎么做、会在哪翻车;等它交活,先盖住描述自己猜,再对账。赌错那个点,正是最该盯住的地方。多数人只吸收 agent 的结论、不押预测,于是跑偏一年后才发现。
2026-06-29

给 agent 做 CLI:你随手写的报错,是它的下一步指令

给 agent 做 CLI,报错不是日志,是接口。拆完飞书 lark-cli 的 35 万行源码,它只要求贡献者内化一条规则:你写的每条错误信息,都会被 AI 解析以决定下一步动作。typed error、stdout/stderr 分流、_notice 递话、lint 护栏,四个能直接抄的设计。
2026-06-25

skill 越写越长,agent 反而越用越偏

Agent 的 skill 不是说明书,是文件夹。我把 agent 生成的 SKILL.md 从 312 行删回 40 行,它才第一次用对:判断标准留在入口,正反例和模板分家,description 写成触发词。附收下一个 skill 前要过的三个问题。
2026-06-22

从"能聊"到"能办":AI 旅行助手卡在哪里

AI 旅行助手卡住的不是"写攻略",而是落地那一步。把旅行拆成去哪、何时、怎么到、能否去、玩什么、行中调整六段,每段有工具,却没人对整趟负责。能聊靠模型,能办靠实时数据、交易库存、规则校验、出错兜底。背后是一张能力网络,缺一块就停在"推荐"。
2026-03-16

工具的进化论:当 MCP 遇见 CLI,一场关于"上下文"的温柔革命

MCP 协议的"上下文爆炸"问题催生了 Skill+CLI 这条更轻量的路线:不把所有工具定义塞进提示词,而是用 CLI 按需调用,以 OpenClaw 为代表的社区实践正在证明这种方式的价值,MCP 与 CLI 未来会混合共存、各司其职。