Skip to content
陈广亮的技术博客

Archives

All the articles I've archived.

2026 93
August 7
  • Fiber 双缓冲教 Agent state 三招:workInProgress、commit、rollback

    blog205 讲了 Fiber 教 Agent 状态设计的 3 条原则,本文把"双缓冲"掰到底:workInProgress 试算、commit 原子切换、rollback 一键丢弃——对应 agent 的 draft 隔离、gate 原子翻转、无成本回滚。答案在 Fiber 里躺了 9 年。这是 fe2agent 番外 C,全系列 13 篇收官。

  • Agent 的 UI 才是前端主场:Chat 只是 fallback

    从 Cursor 到 ChatGPT,Agent 产品长成一模一样的消息气泡列表——不是前端的宿命,是设计的懒惰。Chat 是让人跟不确定输出建立信任的最低成本 UI,一旦信任建立,就该被工具面板、状态观测层、决策 gate 替代。这是《从 useEffect 到 Agent Loop》番外 B。

  • MCP:Agent 界的 npm——供应链的老账,前端可能又要付一次

    十年前 11 行代码撤下、半个 JS 生态挂了;十年后 MCP 长成 Agent 界的 npm,同样的账前端可能又要付一次。这是 fe2agent 系列番外 A,从 left-pad 讲到 typosquatting,讲到我把 chrome-devtools 挂进 cron 的第一次翻车,以及已经发生的 postmark-mcp 第一案。

  • 从抠 bundle 到抠 token:把 Agent 送上生产,再给它一张脸

    前端上线抠 bundle 体积,agent 上线抠 token 账单——手艺是同一门:给看不见的增长装一个看得见的闸。这是 fe2agent 系列第 10 篇(收官),讲 tracing、三层预算熔断、checkpoint 与分布漂移体检,配 tiny-agent v1.0(trace.js 成本三列记账 + 美元熔断 + checkpoint/--resume),并用三把闸复盘那晚 $4200。

  • Flaky 不再是 bug,是本体:前端测试思维怎么迁移到 Eval

    前端里 flaky test 是要修的 bug,agent 世界里 flaky 是本体——同一个任务跑 10 次,7 次完美、2 次啰嗦、1 次自信地错。exact match 必死、单次结果不说明任何事、评测集是你的伤疤集。这是 fe2agent 系列第 9 篇,配 tiny-agent v0.9(evals 用例集 + 多次采样跑通过率 + LLM judge)。

  • Subagent 就是 Web Worker:说不清需求,别怪外包干得烂

    你以为 spawn 一个 subagent 是开线程,其实是雇临时工:它看不见父 agent 的任何历史,brief 里没写的假设一律靠脑补——任务描述是一次有损且无 schema 的序列化。这是 fe2agent 系列第 8 篇,配 tiny-agent v0.8(spawnSubagent + delegate_task 委托工具 + 子循环记账)。

  • 给 AI 弹一个 window.confirm:权限、Hooks 与 human-in-the-loop

    blog06 管"错了怎么救",这一篇管"对了也不能让它直接干"——rm -rf 重试三次都成功才是灾难。权限分级不是开关是光谱,确认要具体到后果,拒绝也是要回给模型的信息。这是 fe2agent 系列第 7 篇,配 tiny-agent v0.7(危险分级表 + 确认门 + JSONL 审计日志)。

July 13
  • 在 Agent 的世界,报错是排期内日常:从 Error Boundary 到 Verifier

    模型自信满满说"完成了",但活没干完——这种不报错的错,try/catch 一层都拦不住。机械故障用重试加指数退避和 max_steps 硬闸,语义故障用 verifier 独立验收,而且验收必须隔离上下文。这是 fe2agent 系列第 6 篇,配 tiny-agent v0.6(withRetry + MAX_STEPS + verifier)。

  • Context 是内存,记忆是硬盘:给 Agent 上 lazy loading

    你以为 agent 记住了你的规则,其实那句话活在昨天 session 的 messages 数组里,今天它醒来就是全新的。Context 是内存,记忆是硬盘:"写下来"才是唯一的持久化,检索-回填就是 agent 界的 lazy loading。这是 fe2agent 系列第 5 篇,配 tiny-agent v0.5(markdown 记忆文件 + 朴素关键词检索 + save_memory/search_memory 两个新工具)。

  • Prompt 是新的 CSS:声明式、会级联、没有 devtools

    改一行 system prompt,agent 行为整个变一副样子——prompt 像 CSS:声明式、会级联、可以覆盖,但没有 devtools 告诉你当前生效的是哪一条。这是 fe2agent 系列第 4 篇,讲 prompt 的层、指令稀释与结构化写法,配 tiny-agent v0.4(同一套工具、两版 system prompt 跑行为对比)。

  • 从 OpenClaw 到 Claude Code:半年后我的配置演化账本

    当时留的两个 TODO 和一个遗憾如今全部翻篇,还长出四件当时想都没想过的东西:memory 变成规则中枢、Skills 进入流水线、双语 i18n 拉出第二条发布线、AdSense 事件反向重塑写作纪律。七条演化,一条一节,一份账本。

  • Tool Call:让 AI dispatch,你来当 reducer

    前端里 dispatch 是你的活、reducer 是你写的;agent 里 dispatch 交给了 AI,reducer 那半边仍然是你的责任。这是 fe2agent 系列第 3 篇,讲 tool schema 三件套、执行权分离、把 AI 当不可信客户端校验,配 tiny-agent v0.3。

  • 模型没有记忆:Context 就是 state,而且每次全量重渲染

    你以为 agent 记得你,其实每轮它都在把整个 messages 数组全量重发——LLM 调用是无状态的,"对话" 是客户端造出来的幻觉。React 有 diff/memo/Fiber 帮你把重渲染压便宜,agent 没有,全量是真的全量。这是 fe2agent 系列第 2 篇,配 tiny-agent v0.2(Context 类 + 历史压缩 + prompt caching)。

  • Agent 就是个 while 循环?——从 UI = f(state) 到 action = LLM(context)

    前端人第一次看 AI Agent 满墙术语懵,其实核心就是个 while 循环——但循环里那个函数不纯、会撒谎、每次返回都不一样。这是系列首篇,从 UI=f(state) 到 action=LLM(context),配一个 32 行可跑的 tiny-agent(Anthropic SDK + 1 个工具),把 agent vs chatbot vs workflow 三分法讲清楚。

  • Fiber 教会我们设计 AI Agent 状态存储的 3 条原则

    React Fiber 掘金上有一篇 6012 热度的深度介绍,同题已被写烂。真正没人写的是 Fiber 三大机制(双缓冲、time slicing、lanes 优先级)如何映射到 AI Agent 状态存储设计。本文从我 blog194/195/202 真做过的 AGENTS.md、loop debt、ponytail 实测经验出发,逐条对应给出 AI Agent 时代该抄的 3 条 Fiber 元规律。

  • Kimi K2.7 Code 进 GitHub Copilot:基准、舆论之后,国产模型第一次拿下"渠道"

    GitHub Copilot 2026-07-01 把 Kimi K2.7 Code 放进模型选择器:第一个 open-weight、也是第一个中国模型。数据经 HF/HN API 与官方定价页亲手核验,拆"开源权重 + Azure 托管 + 企业默认关闭"三层信任结构与两条出海路线。

  • AI 模型对比 2026 年中续篇:blog166 发布 52 天后,我 5 月的判断错了几条

    blog166 发出 52 天后逐条自校验:5 条判断里 2 条反悔(Sonnet/Opus 建议过时、开源差距低估)、1 条待验证(Anthropic 定价)、2 条成立。附我博客 6 个月模型路由的真实观察和下次校验节点。

  • Ponytail 三周 73k star:一个 side project 治好了 AI Agent 过度写代码的病

    DietrichGebert 的 ponytail 2026-06-12 建仓,三周涨到 73k star,覆盖 16 个 agent 生态。核心是 7 步 decision ladder 强制 AI 走 YAGNI。我拿博客里一个 196 行的 TableOfContents 组件跑了 A/B 实测,装 ponytail 后 review 建议是砍到 25-30 行、-84%。本文含实测数据、病毒传播 3 结构性原因、7 步 ladder 逐条拆解、3 反向边界。

  • 微信读书 Agent Skill 拆解:中文互联网内容平台第一个官方玩家,独立开发者的 Skill 商业化窗口打开了吗

    微信读书 2026-05-17 发的 Agent Skill 是中文互联网内容平台第一个"官方玩家"。发布首周社区二创井喷,1.5 个月过去却无一个真正商业化产品。本文拆"官方开放 + 二创井喷 + 零商业化"背后 3 个结构性阻力,以及独立开发者当下真正能吃到的红利。

  • ZCode 登 HN 头版:国产开发者工具第一次被硅谷工程师认真评估

    智谱 GLM-5.2 官方 harness "ZCode" 登 Hacker News 头版(最早 155/192,现在 264/236)。这不是"又一个 AI IDE",而是国产开发者工具首次进入硅谷主流工程师视野。本文拆事件时间线、ZCode 到底是什么形态(不是 CLI 是桌面 app)、HN 里 3 类真实反对声,以及自己接 GLM Coding API 的 30 行 TS 示例。

June 16
May 12
April 15
March 14
February 16