Notes library / curated by subject
不只是笔记列表,
而是一张可继续生长的研究地图。
Featured series
精选笔记 · Agent 工程
Agent 的运行机制、上下文与记忆、评测,以及 Harness 的工程取舍。
01
Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策
Agent Evaluation
02
Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策
Agent Framework
03
Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策
Context Engineering
04
Agent Memory 怎么设计:从失败证据到可验证选型的八个决策
Agent Memory
05
AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定
Agent Evaluation
06
Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视
Context Engineering
07
模型更强以后,还需要重型 Harness 吗?
Harness
全部笔记
2026-09-07
Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策
围绕「Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-09-04
Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策
围绕「Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-09-01
Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策
围绕「Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-29
Agent Memory 怎么设计:从失败证据到可验证选型的八个决策
围绕「Agent Memory 怎么设计:从失败证据到可验证选型的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-26
AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定
围绕「AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-23
Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视
围绕「Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-20
Context7 的上下文工程实践:把「最新文档」做成对 LLM 透明的两段式检索协议
围绕「Context7 的上下文工程实践:把「最新文档」做成对 LLM 透明的两段式检索协议」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-17
cua 的 computer-use 评测实践:驱动、验证与 RL 闭环
围绕「cua 的 computer-use 评测实践:驱动、验证与 RL 闭环」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-14
graphiti 的时序上下文图实践:带有效期的记忆、溯源与增量构建
围绕「graphiti 的时序上下文图实践:带有效期的记忆、溯源与增量构建」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-11
hello-agents 的上下文工程实践:一套从零构建的 GSSC 上下文流水线
围绕「hello-agents 的上下文工程实践:一套从零构建的 GSSC 上下文流水线」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-08
helloagents 框架实践:一本教程配套的 Agent 框架如何组织「循环 / 工具 / 上下文」
围绕「helloagents 框架实践:一本教程配套的 Agent 框架如何组织「循环 / 工具 / 上下文」」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-05
LangGraph 的框架实践:把 Agent 编译成 channel 数据流
围绕「LangGraph 的框架实践:把 Agent 编译成 channel 数据流」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-08-02
letta 的记忆分层实践:core memory、external context 与自我编辑工具
围绕「letta 的记忆分层实践:core memory、external context 与自我编辑工具」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-30
LlamaIndex 的框架实践:Workflow 驱动的检索型 Agent(0.14 新架构)
围绕「LlamaIndex 的框架实践:Workflow 驱动的检索型 Agent(0.14 新架构)」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-27
mem0 的记忆层实践:add/search 两个 API 背后的 ADD-only 提取与多信号检索
围绕「mem0 的记忆层实践:add/search 两个 API 背后的 ADD-only 提取与多信号检索」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-24
MetaGPT 的框架实践:SOP 驱动、角色分工的多智能体组织
围绕「MetaGPT 的框架实践:SOP 驱动、角色分工的多智能体组织」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-21
OpenAI Agents 的框架实践:一个 dataclass 与一套 handoff 编排
围绕「OpenAI Agents 的框架实践:一个 dataclass 与一套 handoff 编排」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-18
opencode 的上下文工程实践:SQLite 消息、摘要式压缩与 provider 层组装
围绕「opencode 的上下文工程实践:SQLite 消息、摘要式压缩与 provider 层组装」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-15
pi 的上下文工程实践:生产 terminal agent 的预算、切点与结构化压缩
围绕「pi 的上下文工程实践:生产 terminal agent 的预算、切点与结构化压缩」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-12
pi 的会话即记忆实践:JSONL 会话树、checkpoint 摘要与项目上下文
围绕「pi 的会话即记忆实践:JSONL 会话树、checkpoint 摘要与项目上下文」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-09
promptfoo 的评测实践:把「评测」做成一条可回归、可进 CI 的流水线
围绕「promptfoo 的评测实践:把「评测」做成一条可回归、可进 CI 的流水线」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-06
Ratel 的上下文工程实践:用渐进式披露把工具目录挡在上下文之外
围绕「Ratel 的上下文工程实践:用渐进式披露把工具目录挡在上下文之外」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-07-03
SkillsBench 的评测实践:用 with-skill vs no-skill 对照回答「技能有没有用」
围绕「SkillsBench 的评测实践:用 with-skill vs no-skill 对照回答「技能有没有用」」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-06-30
TencentDB Agent Memory 的分层记忆实践:符号短时记忆与 L0→L3 语义金字塔
围绕「TencentDB Agent Memory 的分层记忆实践:符号短时记忆与 L0→L3 语义金字塔」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-06-27
MCP 连接了工具,但没有替你完成授权
从连接协议到权限闭环,建立 Agent 工具调用的五层安全边界。
2026-06-24
Token 不是字数:分词、缓存与上下文预算如何改变中文 AI 应用成本
从中文分词、上下文计算与前缀缓存出发,建立可验证的 AI 应用成本账本。
2026-06-21
推理预算不是越多越好:把 Test-time Compute 变成应用路由参数
理解额外推理计算的收益与风险,并用可验证的任务成本建立预算路由策略。
2026-06-18
别再给 Coding Agent 堆提示词
围绕「别再给 Coding Agent 堆提示词」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-06-15
从全量上下文到受控上下文包:pi-java-agent-harness 的上下文加载机制设计
围绕「从全量上下文到受控上下文包:pi-java-agent-harness 的上下文加载机制设计」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-06-12
把冻结模型放进可优化的工程闭环
围绕「把冻结模型放进可优化的工程闭环」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。
2026-06-09
Pi:把 Agent Harness 的控制权留给你
从极简 Loop、会话、扩展与安全边界出发,理解 Pi 如何把 Coding Agent 工作流变成可组合的工程资产。
2026-06-06
模型更强以后,还需要重型 Harness 吗?
Skill、Workflow 与 Harness 并非彼此替代。模型越强,越应将工程控制放回可审查、可替换、能证明的位置。
2026-06-03
Graph Engineering:设计 AI 系统的控制面
从依赖、状态、权限、验证、恢复与成本出发,建立可解释、可约束的 AI 系统执行图。
2026-05-31
Agent 的上下文不是一段 Prompt
把上下文视为最小充分工作集,把记忆视为有进入、更新、验证和退出机制的工作资产。