Systems & engineering
AI 如何从能力走向可靠的系统?
沿着架构、路由、记忆与评测,理解 Agent 如何工作,又在哪里失效。
沿系列深入
全景 → 实践 → 整体思考相关观察与独立文章
检索此方向的全部文章 →独立文章 · AI Agent
AI Agent 八强竞品全景:谁在卖模型,谁在造 Harness,谁在争夺工作入口
Claude Code、Codex、Kimi、WorkBuddy、豆包工作与 Hermes、Pi、DeepSeek Harness 并不处在同一条赛道。本文用三层市场、九个维度和一套选型方法重新理解 2026 年 Agent 竞争。
独立文章 · AI Agent
AI Agent 的可靠性边界:Skills、RAG 与权限能解决什么
从上下文、证据、执行和治理四个层面拆解 Agent 的可靠性瓶颈,对比 Claude Code、Codex、Kimi 与 WorkBuddy 的实际作用,并给出可验收的落地路径。
独立文章 · Coding Agent
Coding Agent Harness 对决:Claude Code、Codex 与三种开源答案
为什么相同模型装进不同 Harness 会像不同产品?从 Agent Loop、上下文、工具、验证、安全、并行和扩展七层,对比 Claude Code、Codex、Kimi Code、Hermes、Pi 与 DeepSeek Harness。
独立文章 · ECC
ECC 架构深度解读:把 AI 编程经验编译成可移植的工程系统
从源码出发拆解 Everything Claude Code 的资产层、安装编译器、Hook 运行时、记忆与学习系统、安全边界及 ECC 2.0 控制平面,并分析它真正解决的问题与架构代价。
独立文章 · Hermes Agent
Hermes Agent 架构深度解读:一个会积累经验的个人 Agent OS
从 Agent Loop、Prompt 分层、四类记忆、工具运行时、子 Agent、Gateway 与安全边界出发,拆解 Hermes Agent 的真实架构,并解释“自我进化”究竟发生在哪里。
独立文章 · LLM 评测
2026 年的 AI 到底能做什么?从模型能力到 Agent 交付边界
先判断哪些工作能交给 AI,再读懂评测依据。用八类基准与最新模型画像,理解 AI 的能力、边界和下一阶段机会。
独立文章 · Pi
Pi 架构深度解读:把 Coding Agent 做成可改造的最小内核
从模型适配、Agent Loop、Session 事件树、上下文压缩与扩展系统出发,拆解 Pi 如何用机制与策略分离构建极简 Harness,并分析其正在演进的分布式架构。