K kedayoungAgent engineering / technical notes

Notes library / curated by subject

不只是笔记列表,
而是一张可继续生长的研究地图。

从代码、实验与一手资料中整理问题、证据与判断。先选择一个方向,再从每一篇笔记深入。

34 篇已发布

精选笔记 · Agent 工程

Agent 的运行机制、上下文与记忆、评测,以及 Harness 的工程取舍。

全部笔记

2026-09-07 Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策 围绕「Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Evaluation 14 min read 2026-09-04 Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策 围绕「Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Framework 12 min read 2026-09-01 Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策 围绕「Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 19 min read 2026-08-29 Agent Memory 怎么设计:从失败证据到可验证选型的八个决策 围绕「Agent Memory 怎么设计:从失败证据到可验证选型的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Memory 15 min read 2026-08-26 AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定 围绕「AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Evaluation 7 min read 2026-08-23 Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视 围绕「Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 6 min read 2026-08-20 Context7 的上下文工程实践:把「最新文档」做成对 LLM 透明的两段式检索协议 围绕「Context7 的上下文工程实践:把「最新文档」做成对 LLM 透明的两段式检索协议」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 6 min read 2026-08-17 cua 的 computer-use 评测实践:驱动、验证与 RL 闭环 围绕「cua 的 computer-use 评测实践:驱动、验证与 RL 闭环」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Evaluation 7 min read 2026-08-14 graphiti 的时序上下文图实践:带有效期的记忆、溯源与增量构建 围绕「graphiti 的时序上下文图实践:带有效期的记忆、溯源与增量构建」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Memory 7 min read 2026-08-11 hello-agents 的上下文工程实践:一套从零构建的 GSSC 上下文流水线 围绕「hello-agents 的上下文工程实践:一套从零构建的 GSSC 上下文流水线」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 6 min read 2026-08-08 helloagents 框架实践:一本教程配套的 Agent 框架如何组织「循环 / 工具 / 上下文」 围绕「helloagents 框架实践:一本教程配套的 Agent 框架如何组织「循环 / 工具 / 上下文」」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Framework 8 min read 2026-08-05 LangGraph 的框架实践:把 Agent 编译成 channel 数据流 围绕「LangGraph 的框架实践:把 Agent 编译成 channel 数据流」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Framework 10 min read 2026-08-02 letta 的记忆分层实践:core memory、external context 与自我编辑工具 围绕「letta 的记忆分层实践:core memory、external context 与自我编辑工具」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Memory 10 min read 2026-07-30 LlamaIndex 的框架实践:Workflow 驱动的检索型 Agent(0.14 新架构) 围绕「LlamaIndex 的框架实践:Workflow 驱动的检索型 Agent(0.14 新架构)」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Framework 9 min read 2026-07-27 mem0 的记忆层实践:add/search 两个 API 背后的 ADD-only 提取与多信号检索 围绕「mem0 的记忆层实践:add/search 两个 API 背后的 ADD-only 提取与多信号检索」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Memory 9 min read 2026-07-24 MetaGPT 的框架实践:SOP 驱动、角色分工的多智能体组织 围绕「MetaGPT 的框架实践:SOP 驱动、角色分工的多智能体组织」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Framework 6 min read 2026-07-21 OpenAI Agents 的框架实践:一个 dataclass 与一套 handoff 编排 围绕「OpenAI Agents 的框架实践:一个 dataclass 与一套 handoff 编排」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Framework 9 min read 2026-07-18 opencode 的上下文工程实践:SQLite 消息、摘要式压缩与 provider 层组装 围绕「opencode 的上下文工程实践:SQLite 消息、摘要式压缩与 provider 层组装」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 9 min read 2026-07-15 pi 的上下文工程实践:生产 terminal agent 的预算、切点与结构化压缩 围绕「pi 的上下文工程实践:生产 terminal agent 的预算、切点与结构化压缩」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 7 min read 2026-07-12 pi 的会话即记忆实践:JSONL 会话树、checkpoint 摘要与项目上下文 围绕「pi 的会话即记忆实践:JSONL 会话树、checkpoint 摘要与项目上下文」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Memory 8 min read 2026-07-09 promptfoo 的评测实践:把「评测」做成一条可回归、可进 CI 的流水线 围绕「promptfoo 的评测实践:把「评测」做成一条可回归、可进 CI 的流水线」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Evaluation 7 min read 2026-07-06 Ratel 的上下文工程实践:用渐进式披露把工具目录挡在上下文之外 围绕「Ratel 的上下文工程实践:用渐进式披露把工具目录挡在上下文之外」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Context Engineering 8 min read 2026-07-03 SkillsBench 的评测实践:用 with-skill vs no-skill 对照回答「技能有没有用」 围绕「SkillsBench 的评测实践:用 with-skill vs no-skill 对照回答「技能有没有用」」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Evaluation 8 min read 2026-06-30 TencentDB Agent Memory 的分层记忆实践:符号短时记忆与 L0→L3 语义金字塔 围绕「TencentDB Agent Memory 的分层记忆实践:符号短时记忆与 L0→L3 语义金字塔」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Memory 7 min read 2026-06-27 MCP 连接了工具,但没有替你完成授权 从连接协议到权限闭环,建立 Agent 工具调用的五层安全边界。 Harness Engineering 30 min read 2026-06-24 Token 不是字数:分词、缓存与上下文预算如何改变中文 AI 应用成本 从中文分词、上下文计算与前缀缓存出发,建立可验证的 AI 应用成本账本。 应用导向 AI 原理 25 min read 2026-06-21 推理预算不是越多越好:把 Test-time Compute 变成应用路由参数 理解额外推理计算的收益与风险,并用可验证的任务成本建立预算路由策略。 应用导向 AI 原理 20 min read 2026-06-18 别再给 Coding Agent 堆提示词 围绕「别再给 Coding Agent 堆提示词」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Agent Engineering 6 min read 2026-06-15 从全量上下文到受控上下文包:pi-java-agent-harness 的上下文加载机制设计 围绕「从全量上下文到受控上下文包:pi-java-agent-harness 的上下文加载机制设计」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Harness Engineering 8 min read 2026-06-12 把冻结模型放进可优化的工程闭环 围绕「把冻结模型放进可优化的工程闭环」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。 Harness Engineering 5 min read 2026-06-09 Pi:把 Agent Harness 的控制权留给你 从极简 Loop、会话、扩展与安全边界出发,理解 Pi 如何把 Coding Agent 工作流变成可组合的工程资产。 Harness Engineering 19 min read 2026-06-06 模型更强以后,还需要重型 Harness 吗? Skill、Workflow 与 Harness 并非彼此替代。模型越强,越应将工程控制放回可审查、可替换、能证明的位置。 Harness Engineering 19 min read 2026-06-03 Graph Engineering:设计 AI 系统的控制面 从依赖、状态、权限、验证、恢复与成本出发,建立可解释、可约束的 AI 系统执行图。 Agent 基础概念 32 min read 2026-05-31 Agent 的上下文不是一段 Prompt 把上下文视为最小充分工作集,把记忆视为有进入、更新、验证和退出机制的工作资产。 Agent 基础概念 22 min read