代码、项目和笔记

你好,我是kedayoung。

我主要开发 Agent 和 AI 开发工具。 这里分享项目进展、源码阅读笔记,以及实验中的发现和疑问。

正在做 / Harness · M-Agent · ZhoMind-v2 · Stock Profiler
关心的问题 / 上下文怎么选 · 记忆怎么存 · 工具权限怎么管
平时记录 / 源码阅读 · 实验结果 · AI 动态
还在进行中
项目还在做,笔记里也有没想明白的问题。代码和参考资料都附了链接, 欢迎指出错误,或聊聊你的做法。
01

公开项目

最近在做的四个项目,涉及 Agent 任务执行、运行机制、个人知识库和投资研究。

01 / TS V1 可运行
持续迭代

Harness

Agent 控制层 / 持久任务
问题

Codex、Claude Code 与已审批 Skill 各自运行时,路由、权限、长任务和交付状态缺少一个可审计的控制面。

能力

统一 execute / watch 接口,覆盖工作流与角色分工、预算审批、暂停恢复、事件账本和隔离 worktree。

我的贡献

从产品边界、权限模型与事实源出发,设计并实现 TypeScript Kernel、双宿主执行器、CLI / MCP 接口和验收测试。

02 / PY 可运行
教学型框架

M-Agent

最小 Agent 框架 / 学习路径
问题

大型框架的抽象会遮住 Agent 的核心机制,新手很难看清模型决策、工具执行与消息回填如何构成闭环。

能力

从最小 Agent 循环扩展到 memory、trace、guardrails、RAG、workflow、受控 multi-agent 与确定性 eval。

我的贡献

用可读代码拆出 Message、Tool、ModelClient、Agent 四个核心抽象,并持续补齐离线示例、测试与进阶能力。

03 / PY 全栈原型
Smoke 路径

ZhoMind-v2

个人知识库 / 检索对话
问题

私有资料上传后仍散落在文件与会话中,缺少可维护的解析、索引、检索和连续对话链路。

能力

文档上传与任务构建、稠密检索、会话记忆、Provider 路由与故障切换,并提供真实 Milvus E2E 验证路径。

我的贡献

搭建 Vue + FastAPI 全栈,贯通资料处理、RAG 运行时、SSE 会话与可选 Milvus / MinIO / Redis 基础设施。

04 / BUILD 0.1.0.dev0
工程基线

Stock Profiler

个人投资决策支持 / 安全边界优先
问题

个人投资决策需要明确的事实边界、可恢复的运行时和可审阅的风险约束;第一阶段必须先证明系统不会把不完整数据或模型输出误写成公开建议与交易。

能力

Python 应用宿主、Pinned M-Agent 0.5.0 Runtime、启动冻结配置、分离 SQLite 状态、CLI / FastAPI 诊断契约与 React / PWA 壳层。

我的贡献

从单一用户、非公开荐股与不写入订单的安全边界出发,设计并实现应用宿主、版本诊断、配置冻结、状态所有权与公开合成验证基线。

02

AI 日报

记录每天关注的 AI 新闻、开源项目和社区讨论,附上原文链接,也写一点自己的看法。

03

技术笔记

读源码和做实验时留下的笔记:一个机制怎么实现,为什么这样设计,还有哪些地方没弄清楚。

笔记 01 / Agent Evaluation

Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策

围绕「Agent Evaluation 怎么设计:从一次失败到持续回归门禁的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。

继续阅读 →
笔记 02 / Agent Framework

Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策

围绕「Agent Framework 怎么设计:从隐式循环到可恢复运行时的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。

继续阅读 →
笔记 03 / Context Engineering

Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策

围绕「Context Engineering 怎么设计:从消息堆积到可审计工作集的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。

继续阅读 →
笔记 04 / Agent Memory

Agent Memory 怎么设计:从失败证据到可验证选型的八个决策

围绕「Agent Memory 怎么设计:从失败证据到可验证选型的八个决策」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。

继续阅读 →
笔记 05 / Agent Evaluation

AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定

围绕「AgentBench 的评测实践:一个学术综合基准的框架、调度与确定性判定」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。

继续阅读 →
笔记 06 / Context Engineering

Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视

围绕「Caveman Compression 的实践:用「可预测性」做语义压缩的三种实现与批判性审视」的源码导向研究笔记,记录核心机制、系统边界与可复用的工程判断。

继续阅读 →
浏览全部笔记与分类
04

关于

一点个人背景,以及为什么做这个网站。

最近主要在折腾 Agent。

我的专业是计算机科学与技术,目前主要研究和开发 Agent: 一边读开源项目的实现,一边在自己的项目里尝试和验证。

开发过程中,我尤其关注任务中断后的恢复、工具调用的权限,以及执行结果的检查。 比如,任务重启后如何避免重复操作,哪些步骤应该交给人确认,又该用什么测试判断任务是否完成。

做这个网站,是想把散在仓库和笔记里的东西放到一起,方便自己回头查, 也方便和有相似兴趣的人交流。项目做到哪一步、试过什么、还有什么没解决,都会尽量写清楚。

05 / 联系

欢迎来聊聊。

你也在做 Agent,或者对这里的某个项目、某篇笔记有想法,都可以联系我。 问题、建议和不同意见都欢迎。

可以发邮件,也可以在对应的 GitHub 仓库提 issue。

邮箱 kedayoung@163.com GitHub @lingdu0007 ↗