Archives
All the articles I've archived.
-
从 Copilot 到 Chief of Staff:企业 AI 应用范式的一次系统追问
The Loop 011 讨论了 Agent 稳定性的技术层面,这一期回到更高的追问:当一家企业深度使用 AI 之后,工作的默认起点会变成什么样?沿着 Customer Zero、Skill 蒸馏、Prescriptive Sales、"My Day" 工作流、Palantir Ontology、嵌入式采用这条线,把"AI 从被动助手到主动参谋"的范式转变逐层拆开。
-
从 Hermes Kanban 到确定性 DAG:多 Agent 协同和 AI 稳定性的一次系统追问
从一张 Hermes Kanban 截图起步,追问它到底是什么、跟 Multica 之类的"Agent 管理平台"是什么关系;再顺着"AI Agent 怎么才能稳定跑复杂流程"一路问下去,把 DAG 和状态机、Plan-and-Execute、LangGraph、原生 asyncio 手写 DAG、以及意图路由/看门狗模式串成一条线。终点是一个直观的分层认知:静态骨架 + 动态计划 + 前置路由,才是当下企业级 Agent 编排的稳态解法。
-
从一句 make it look like a Qt app 到设计系统地图:怎么减少 AI 前端的 Slop
一场关于“怎么减少 AI 生成前端的塑料感”的追问。起点是 Volpe 的实验:同一个网页换过许多视觉风格,AI 味仍然附着在上面,直到他要求 Codex “make it look like a Qt app”。从这句提示词继续追问,逐步拆开 Qt Widgets、设计模式、设计语言、设计系统、组件库和视觉风格的区别,并整理 Material 3、Apple HIG、Fluent 2、Carbon、Ant Design、Primer、Polaris 等体系各自适合的产品类型,给出一套更可控的 AI UI 提示词写法。
-
从《Building Effective Agents》到 Claude Code 动态工作流:把 Agent 编排的 5+6 种模式一次讲清楚
一场关于 "AI 编排到底有多少种基础模式" 的追问——从 Anthropic 2024 年 12 月《Building Effective Agents》里的 5 种基础工作流,到 2026 年 6 月 Claude Code 动态工作流(Dynamic Workflows)的 6 种运行时模式。中间穿插两者的关系(静态积木 vs 动态编排)、Evaluator-Optimizer 到底属于哪一类、以及这些模式各自解决 LLM 的什么失败模式(智能体惰性、自偏好偏差、目标漂移)。最后落到一张选型对照表——什么任务用哪一种,为什么。
-
从 Claude Builds Visuals 到《HTML 的不合理有效性》:为什么 2026 年的 AI 输出开始用 HTML 取代 Markdown
一场关于"AI 输出到底应该长什么样"的追问——从 Anthropic 2026 年 3 月 12 日 Claude Builds Visuals 内联可视化功能,到 5 月 8 日 Claude Code 团队工程师 Thariq Shihipar《HTML 的不合理有效性》主张用 HTML 取代 Markdown。中间穿插 SVG 相对位图/Canvas 的技术优势、内联可视化与 Artifacts 的定位差异、Karpathy "Voice in, Visuals out" 的公开跟进,以及 Kurtis Redux 反方文章《HTML 的不合理无效性》关于 token 成本 2–6x 的批评,最后落到"Markdown 是后台工作语言,HTML 是前台展示界面"这条务实分工。
-
物理熵 vs 信息熵:从墨水扩散到 Hidalgo 的'结晶化想象力',以及 AI 在 2026 年怎么动摇了它
一场围绕"熵"的层层追问——从物理学和信息论看似冲突的价值判断(一个怕熵增、一个爱熵增)开始,用 Boltzmann 公式、4 枚硬币、墨水扩散、水/冰相变把两套理论数学统一,再用热力学三大定律把"为什么时间不能倒流"讲清楚,最后衔接到 Hidalgo《增长的本质》"信息=物理秩序"的经济学框架,并在 2026 年用生成式 AI、具身智能、无形经济三组证据反向审视 Personbyte 与 Knowhow 不可传输的预设。
-
Managed Agents 与同类开源产品对比:LangGraph、E2B、SWE-agent、OpenHands 各守一层
一场围绕 Anthropic Managed Agents 与同类开源产品的对照式追问——Checkpoint 究竟归 Session 存还是归 Harness 管?emitEvent / getEvents 是开发者能直接调用的 API 吗?"向量数据库语义召回"是官方原生还是生态扩展?最后扩展到三层对照地图:LangGraph Checkpointer 守 Session 层、E2B microVM 守 Sandbox 层、SWE-agent 与 OpenHands 守 Harness 控制循环、Mastra 与 Vercel AI SDK 在不同层各司其职。
-
智能体记忆系统解剖:当下 Agent '记忆库'与认知科学的差距
一场围绕智能体记忆系统的层层追问——从认知科学对人类记忆的经典分类(情节/语义/程序/工作记忆),到 Mem0、Graphiti、LangMem 这些主流 Agent 记忆库的真实工程实现,再到 Anthropic Dreams 与 Letta sleep-time compute 代表的离线巩固正路。把"概念高大上、工程靠打标签"的伪记忆架构,放在显微镜下解剖一遍。
-
MCP 企业多用户认证:从 Harness 凭证隔离到 OAuth 2.1 动态授权全链路
深入拆解企业级 AI Agent 的多用户身份认证架构——Harness 如何动态注入凭证、Token 为什么不能存在 Session 里、MCP 协议如何借助 OAuth 2.1 和 RFC 8707 实现工具层的零信任安全隔离。
-
Managed Agents 架构拆解:Harness、动态工具路由与 Prompt Cache 的工程博弈
从企业管理者视角出发,逐步深入 Anthropic Managed Agents 的 Harness 调度架构、脑手分离设计、SLM 前置工具剪枝方案,以及动态工具路由与 Prompt Caching 严格前缀匹配之间的工程冲突与破局之道。
-
AI 流式输出处理:从 Buffer 原理到 Agent 工具调用隐藏
从流式输出的 Buffer 缓冲区原理讲起,逐步深入到流式 Markdown 渲染、Agent 工具调用的状态机过滤,以及"隐藏内容不等于变慢"的性能认知校准。
-
Agent 首字延迟(TTFT)优化:从原理到落地
从"首字为什么慢"的底层原理出发,逐步追问到快慢多级路由、Prompt Caching 与动态工具加载的冲突、Anthropic Managed Agents 架构解耦,以及 DeepSeek 上的缓存预热落地。
-
Claude Code 512,000 行代码里的秘密
2026年3月底,Anthropic 意外泄露了 Claude Code 的全部源代码。我在这些代码里泡了很久。这个系列,是我从中看到的东西。
-
Skill 工程化建设指南:从"写 Prompt"到"构建 AI Know-How 工程"
Skill 不是"写出来"的,是"构建出来"的。本文解构 Anthropic Skill 体系,阐述为什么构建 Skill 是一项需要多角色协作的工程,而非一次性写作。
-
2025 AI 年度回顾:RLVR、氛围编程与 AI"幽灵"降临
基于 Andrej Karpathy 和 Simon Willison 两位大神的年度回顾,结合播客讨论,梳理 2025 年 LLM 领域三个关键变化:RLVR 重塑训练范式、编码代理引爆生产力、以及锯齿状的幽灵智能意味着什么。