king-of-water · 个人博客

你好,我是
king-of-water。

这里记录后端、Agent 实践、项目,以及真正用过的工具。

Pi Agent:一个 Agent Harness 最小可以小到什么程度

从 Pi 的 Agent Loop、统一模型接口、工具契约、消息队列和扩展系统出发,理解一个可用 Agent 最少需要哪些运行时能力。

Pi AgentAgent HarnessAgent LoopTool CallingContext Engineering

DSH:Everything is a Plugin,Agent Harness 如何被拆成可组合能力

解析 DeepSeek Harness 的插件化架构、Cordis 运行时、能力接缝与可替换 Agent Loop,理解插件系统怎样进入 Agent 基础设施内部。

DeepSeek HarnessDSHCordisPlugin ArchitectureAgent Runtime

Jev:为什么 Agent 需要一个比 LLM 更快的控制层

Jev 不生成长文本,而是对有限答案返回类型化决策与概率。本文从 REFLEX、Jev-Mem 和评测 Judge 三个场景分析这种 System One 模型怎样进入 Agent 控制平面。

JevSystem One ModelAgent Control PlaneModel RoutingAgentic Memory

Agent 自进化:它究竟在修改什么

从 Context、Memory、Skill、Workflow、代码到模型权重,梳理 Agent 自进化的对象、反馈信号、更新周期与安全边界。

Agent 自进化Self-Evolving AgentsACEEvoSkillDarwin Gödel MachineAlphaEvolve

Agent 评测闭环:决定进化是否真的有效

从任务结果、执行轨迹、确定性检查、LLM Judge、冻结留出集到灰度与回滚,搭建能支撑 Agent 自进化的评测闭环。

Agent EvaluationEvalsLLM JudgeReward HackingAgent 自进化Observability

Claude Code 架构拆解:Query Loop、Compact 与 Memory

以 Anthropic 官方文档为事实边界,结合特定版本的客户端还原资料,拆解 Claude Code 的主循环、上下文装配、五层压缩、自动记忆、工具权限与子 Agent。

Claude CodeAgent HarnessQuery LoopCompactMemoryContext EngineeringSubAgent