源码证据与项目地图
English | 中文
每项结论都应能回到源码、测试或明确限制
本页不是文件清单。它说明蓝皮书怎样覆盖项目、八项判断由什么证据支撑,以及哪些问题当前仍不能从仓库证明。
从架构和全部一方包组 README 建立能力地图。
沿 Agent 主路径、治理路径和失败边界进入源码与测试。
主动寻找 POC、非安全边界、不可恢复和协议限制。
证据方法
第一遍阅读架构总览、包组地图以及 packages/ 下全部一方包组 README,回答“项目有哪些能力族、它们怎样组合”。第二遍沿 Agent 创建、模型请求、工具执行、会话持久化、客户端投影、subagent、workflow、sandbox 和多协议入口进入核心源码与测试,回答“真实任务怎样运行、失败时发生什么”。
vendor/ 是按清单同步的 Cordis 上游副本,不作为产品创新结论的独立来源;native/ 与 python/ 通过各自 README 和消费路径纳入覆盖。业务价值只在实现机制可以支撑时推导,市场收益、生产规模和行业完成度不从代码推测。
项目能力地图
| 项目区域 | 主要职责 | 蓝皮书中的位置 |
|---|---|---|
core/ | 会话、提示词、工具、Agent 与 agent loop | 一次任务怎样运行 |
api/ 与 typert/ | 远程 BFF、类型图、loader 和 RPC registry | 多界面共享类型化能力 |
llm/ | LLM Service Definition、目录、适配器和 DeepSeek 提供方 | 能力 seam 与模型配置 |
shell/、subprocess/、terminal/ | 命令、进程树和持久终端执行 | 工具执行与环境约束 |
fs/ 与 lsp/ | 文件能力、策略和语言服务器 | 研发场景与文件治理 |
skill/ 与 web/ | skill 注册、目录、加载器、搜索和抓取 | 知识作业场景 |
context/ 与 compaction/ | 请求上下文和模型历史压缩 | 长会话与可回放上下文 |
subagent/ 与 workflow/ | 委派、可继续子 Agent 和动态工作流 | 长任务协作与限制 |
todo/、plan/、goal/、jobs/、schedule/ | 计划状态、目标、后台任务与定时执行 | 可观察的任务推进 |
preset/、bundle/、boot/ | 每会话组装、安装组合和应用启动 | 一切皆插件与平台化 |
guard/ 与 interaction/ | 循环卫生、超时、命令、权限、审批和询问 | 工具治理与人工控制 |
session/ | 持久化、投影、标题、遥测和查询 | 恢复、回放与证据 |
settings/、credentials/、identity/ | 用户设置、凭据引用和匿名身份 | 配置治理与 secret 分离 |
client/ 与 host/ | 浏览器运行时、UI 模组、Host 与 API 代理 | 插件化业务界面 |
acp/、sdk/ 与 python/ | 自动化协议、JSON-RPC 与两种 SDK | 多种接入方式 |
hooks/ 与 extensions/ | 外部工具桥接和运行时自修改 | 生态接入与受信动态扩展 |
sandbox/、e2b/、code-runtime/ | 文件限制、远程执行 POC 和脚本运行 | 治理边界与当前限制 |
examples/、support/、util/ | 可运行组合、测试设施和零依赖工具 | 组装验证与工程支撑 |
八项创新的证据索引
| 结论 | 主要源码或文档 | 代表性测试证据 | 置信度与限制 |
|---|---|---|---|
| 一切皆插件 | 架构总览、bundle 包组、应用启动 | preset 挂载测试 | 高;插件信任由部署组装决定 |
| 完整能力 seam | 能力 seam 规则、LLM 包组、E2B POC | 本地 sandbox 测试 | 高;提供方安全属性不相同 |
| 模型所见可回放 | 会话实现、Agent loop | 请求重建测试、会话属性测试 | 高;合规保留策略不在日志内 |
| 工具治理流水线 | 工具注册表、审批服务 | 工具行为测试、审批测试 | 高;只覆盖经工具注册表调度的动作 |
| 每会话 Agent 组装 | Agent preset 实现 | 会话 preset 测试、发现测试 | 高;不是企业租户系统 |
| 长任务可观察协作 | subagent 包组、workflow 包组 | continuation 测试、workflow 集成测试 | 高;动态 workflow 不跨重启恢复 |
| 多种接入方式 | ACP、SDK、Python | ACP 轮次测试 | 高;各协议只公开自己的子集 |
| 客户端插件图 | 客户端模组、Web 运行时 | 模组 loader 测试、conversation 测试 | 高;领域 UX 仍需产品设计 |
关键主路径定位
Agent 与模型请求
Agent loop记录 turn/start、step/start、用户消息、流式 assistant 内容、工具调用与结束原因,并用 deriveMessages() 形成下一次请求。会话实现拥有事件追加、表层投影、格式加载、fork 和消息派生。
工具与批准
工具注册表声明 guard、执行阶段、结果和呈现意图。审批服务声明 ask/never、失败关闭和可回放审计事件。两者共同证明“模型提出调用”与“动作获准执行”是不同阶段。
会话组装与恢复
Agent preset拥有发现、解析、standing mount、重组限制和作用域服务读取。会话持久化提供写入、读取和准备路径;continuable subagent 在自己的会话中保存描述与委派策略。
界面与协议
Web 运行时从会话窗口构建 conversation 与 trajectory 投影。ACP公开更窄的自动化接口,只发送已提交 assistant 文本;SDK 通过 JSON-RPC 驱动同一 Agent 与会话服务。
用反证界定结论
| 如果发现以下事实 | 会推翻或收窄哪项结论 | 当前检查结果 |
|---|---|---|
| 模型可见内容没有对应会话事件 | “模型所见可回放” | 主请求路径要求先记录;未发现例外 |
| 工具可在 guard 拒绝后重新允许 | “治理流水线单调收紧” | guard 类型没有 allow 分支 |
| 子 Agent 可以在无人观察时弹窗升权 | “委派权限固定” | 委派写入 approval/policy: never |
| 动态 workflow 能在重启后续跑 | “当前无恢复”限制失效 | README 明确无 journal 或 resume |
| SandboxMode 同时限制网络与凭据 | “只表达文件效果”限制失效 | 服务词汇明确排除网络、进程、syscall、设备与凭据 |
当前仓库不能证明什么
- 不能证明某个行业已经拥有开箱即用的完整解决方案;仓库提供通用能力与示例组合。
- 不能证明生产规模、可用性目标或单位经济性;需要目标部署的容量测试和账单数据。
- 不能证明会话日志自动满足任何具体监管要求;合规解释依赖身份、存储和制度。
- 不能证明任意模型生成代码可以安全运行;多个 worker/vm 实现明确不构成恶意代码安全边界。
- 不能证明多 Agent 对所有任务都更快或更好;并行收益取决于任务可分解性、汇总和资源成本。
从业务结论进入主路径,再读限制和测试
初学者先读“从任务到证据”;架构与平台评估者按本页索引进入 owner 包;安全评审者从“治理边界”反向检查部署条件。README 解释约定,源码确认实现,测试证明关键分支被持续执行。
证据状态:除特别标注外,本页基于当前 worktree 的源码、测试和文档已确认;未运行真实 DeepSeek API、生产负载或目标企业系统验证。