pi 源码解读|pi 是一个怎样的 Agent Harness?
从 pi-mono 的包边界、AgentSession、ResourceLoader、Extension 与 SessionManager 出发,解释 pi 的可编程边界,以及把它放进 Local First Agent OS 时哪些能力仍需自己构建。
A collection of 11 posts about agent.
从 pi-mono 的包边界、AgentSession、ResourceLoader、Extension 与 SessionManager 出发,解释 pi 的可编程边界,以及把它放进 Local First Agent OS 时哪些能力仍需自己构建。
带读 Claude Code 的大型代码库指南:从一个找错登录链路的任务出发,理解目录规则、受限读取、代码智能与跨包计划如何让 Agent 看见恰好够用的代码。
从 Pi 的 Agent、AgentSession 与 Extension API 出发,解释它为何是适合改造的 Agent Harness,以及它距离 Hermes、OpenClaw、nanobot 这类个人 Agent OS 还缺哪些运行时层。
结合 OpenAI Cookbook、Claude Code 与 GitHub Spec Kit 的官方资料,拆开 Plan Mode、执行计划、Goal、Spec、Skill 和仓库规则各自负责的工程边界。
从 Slack 上下文、团队共享会话、Agent Identity、工具权限与持续记忆五个层面,拆解 Claude Tag 和群聊总结机器人的真实边界。
从 OpenAI Cookbook 的 Codex Goals 出发,拆解持久目标、证据审计与自动续跑怎样组成完成协议,并对比 Claude Code 的独立判定循环。
沿着 OpenAI Cookbook 的 Macro Evals 工作流,拆解它如何从大量 Agent Trace 中归并重复故障、排序高影响模式并回溯根因候选。
从 Claude Code Dynamic Workflows 与 LangGraph 的运行机制出发,解释 Graph engineering 和 workflow 的真实边界,以及怎样系统地设计节点、状态、路由、异常与约束。
从 resume、fork、compact 与新 chat 的差异出发,介绍怎样把目标、决策、进度和验证结果落到仓库文件,让 Codex 在不继承旧聊天历史的情况下继续长期任务。
从真实任务、模型表现和评分链路拆解 ClawBench,并通过混淆矩阵重新审视 Agent-as-Judge 的可靠性证据。
从流程、约束、持久化、上下文、工具和运行环境六个维度,基于源码对比 Codex、Claude Code 与 OpenCode 的 Harness 设计、取舍与差距。