按首次出现的节分组。个别符号在不同节中承担相近但不同的含义(继承自各子领域的惯例),在"备注"列中已注明重载关系。
| 符号 | 含义 | 备注 |
|---|---|---|
| $\mathcal{A}=(\pi,\mathcal{H})$ | 智能体复合系统:模型 $\pi$ + 外部装置 $\mathcal{H}$ | 全报告核心定义 |
| $\mathcal{H}_{\text{mem/act/safe/coop/intf}}$ | Harness 五大子系统(记忆/行动/安全/协作/接口) | |
| $\mathcal{I}_T(n)$ | 任务 $T$ 执行到第 $n$ 步的累计信息量 | 第 5 节简写为 $\mathcal{I}(\cdot)$ |
| $W$ | 上下文窗口预算(token 数) | 与第 2 节共用 |
| $H$ | 任务视界长度 | 与第 2 节"完整历史 $H$"重载,依上下文区分 |
| $o_t,\,a_t$ | 第 $t$ 步的观测与动作 | |
| $\tau$ | 完整轨迹 $(o_1,a_1,\dots,o_n,a_n)$ | 与第 2 节"压缩触发时刻 $\tau$"重载 |
| $\text{ctx}_{\mathcal{H}}(\cdot)$ | Harness 的上下文组装函数 | |
| $\mathcal{M}=(\mathcal{S},\mathcal{O},\mathcal{A},T,Z,R)$ | POMDP 六元组 | $T$ 此处为转移函数,与任务 $T$ 依上下文区分 |
| $b_t$ | 信念状态 | |
| $\text{Risk}(\cdot),\,V(\cdot)$ | 行动风险函数 / 信息价值函数 |
| 符号 | 含义 | 备注 |
|---|---|---|
| $\theta$ | 占用率阈值(触发压缩),典型 $0.75\sim0.8$ | |
| $x_i,\,T(\cdot)$ | 第 $i$ 组分的 token 占用 / token 估算函数 | |
| $\Gamma$ | 压缩算子:历史 $h \mapsto$ 摘要 $\hat{h}$ | 全报告核心算子 |
| $\beta$ | 压缩后尺寸参数:$\|\Gamma(h)\|\le\beta W$,典型 $0.1\sim0.3$ | |
| $\rho$ | 信息保留率 | 第 5 节用作"摘要压缩比",概念同源 |
| $Q(\cdot),\,C(\cdot)$ | 压缩质量函数 / 压缩成本函数 | |
| $s_t=\mathrm{fold}(e_1,\dots,e_t)$ | 事件溯源的状态折叠;$e_i$ 为事件 | 第 6 节公理 1 |
| $\oplus$ | 状态合并算子 | |
| $k$ | 检查点基线之后的事件数;重放复杂度 $O(k)$ | |
| $I(\cdot\,;\cdot)$ | 互信息(信息瓶颈目标 $I(T;\Gamma(H)\mid Y)$) | |
| $Y$ | 用户意图 |
| 符号 | 含义 | 备注 |
|---|---|---|
| $\Phi$ | Turn 状态机的转移函数 | 状态集:Pre→Compacting→ContextBuilding→Sampling⇄ToolExecution→Complete |
| $\pi(o_t)$ | 采样:模型基于观测生成动作 | |
| $\mathcal{A}_{shell},\,\bigcup_i\mathcal{A}_{tool_i}$ | 通用 shell 动作空间 / 细粒度工具动作空间并集 | 表达能力 vs. 判定复杂度(多项式级 vs. PSPACE 级) |
| $T_{\text{serial}}=\sum_i t_i$ | 串行工具执行总时延 | |
| $T_{\text{parallel}}=\max_i t_i+\delta$ | 并行执行时延;$\delta$ 为调度开销 |
| 符号 | 含义 | 备注 |
|---|---|---|
| $\mathcal{A}_{free},\,\mathcal{A}_{gated},\,\mathcal{A}_{denied}$ | 动作空间三分:免审批 / 需审批 / 禁止 | 第 6 节公理 4 |
| $\lambda_{ask}$ | 单位任务打扰率(人工确认次数期望) | |
| $R=\sum_t P(\text{unsafe}\mid a_t)\cdot\text{Impact}(a_t)$ | 风险暴露度量 | |
| $P_i,\,\epsilon_i$ | 第 $i$ 层过滤器的通过率 / 漏检率;级联联合漏检 $1-\prod_i(1-\epsilon_i)$ | |
| $C_{\text{FN}}\gg C_{\text{FP}}$ | 误放代价远大于误拒代价(不对称公理) | 第 6 节公理 5 |
| $p_t$ | 第 $t$ 步事故概率;累积 $\Pr(\text{incident})=1-\prod_t(1-p_t)$ |
| 符号 | 含义 | 备注 |
|---|---|---|
| $\Delta\mathcal{I}$ | 委派的上下文收益:主窗口节省的信息量 | 分解收益条件 $\Delta\mathcal{I}>\mathcal{C}_{comm}$ |
| $\mathcal{C}_{comm}$ | 主-子代理通信成本(token) | |
| $G=(V,E)$ | 代理委派关系有向图 | 可审计性基础 |
| $C_{\text{core}}+\sum_j C_{\text{proj}_j}$ vs. $\sum_j C_j$ | 一次构建多投影 / 各形态独立实现的成本对比 | 第 6 节公理 7 |
本报告全部论断的代码级证据来自配套的 39 章源码解析文档(位于 codex-analysis/ 目录,约 2.66 万行)。正文中(见第 NN 章)标注与此处的对应关系如下。
| 报告节 | 主题 | 对应章节 |
|---|---|---|
| 第 1 节 | 问题形式化 | Ch01 项目全景、Ch08 Turn 引擎、Ch13 上下文总论 |
| 第 2 节 | 上下文经济学 | Ch13–Ch19(上下文管理、窗口组装、本地/远程压缩、Rollout、会话前缀、提示词与记忆) |
| 第 3 节 | 决策循环与行动接口 | Ch07–Ch11(会话、Turn、流式、事件、中断)、Ch20–Ch23(工具总论、Shell、Apply-Patch、检索) |
| 第 4 节 | 安全边界与自主性 | Ch24 审批流、Ch27–Ch32(安全总论、Linux/macOS+Windows 沙箱、策略引擎、提权、护栏) |
| 第 5 节 | 分解与形态复用 | Ch12 状态持久化、Ch33–Ch39(多智能体、委派、AppServer、MCP Server、无头执行、TUI、SDK) |
| 章 | 标题 | 章 | 标题 |
|---|---|---|---|
| 01 | 项目全景与发展演进 | 21 | Shell 命令执行引擎 |
| 02 | 工作区拓扑与分层架构 | 22 | Apply-Patch 代码编辑 |
| 03 | 启动链路与进程模型 | 23 | 检索能力:文件搜索与网络 |
| 04 | 配置系统与用户控制面 | 24 | 工具审批流 |
| 05 | 模型接入层与 API 协议 | 25 | 技能系统 Skills |
| 06 | 功能开关与插件体系 | 26 | MCP 客户端与 Hooks |
| 07 | 会话与线程模型 | 27 | 安全体系总论 |
| 08 | Turn 引擎与执行循环 | 28 | Linux 沙箱实现 |
| 09 | 模型流式交互与响应处理 | 29 | macOS 与 Windows 沙箱 |
| 10 | 事件系统与状态广播 | 30 | 命令策略引擎 ExecPolicy |
| 11 | 中断取消与错误恢复 | 31 | 提权与进程加固 |
| 12 | 状态持久化与线程存储 | 32 | 安全护栏与网络策略 |
| 13 | 上下文管理总论 | 33 | 多智能体架构总论 |
| 14 | 历史记录与窗口组装 | 34 | 代理委派与通信机制 |
| 15 | 自动压缩:本地 compaction | 35 | AppServer 协议层 |
| 16 | 自动压缩:远程 compaction | 36 | MCP 服务器形态 |
| 17 | Rollout 持久化与会话恢复 | 37 | 非交互执行与云端任务 |
| 18 | 会话前缀与实时上下文 | 38 | TUI 交互界面架构 |
| 19 | 提示词工程与记忆系统 | 39 | SDK 生态与扩展接口 |
| 20 | 工具系统总论 |
源码解析文档另有总目录 README.md(含阅读路线与"长程智能体设计十大原理"),可与本报告互为索引。