Skip to content

源码证据与项目地图

English | 中文

06SOURCE EVIDENCE

每项结论都应能回到源码、测试或明确限制

本页不是文件清单。它说明蓝皮书怎样覆盖项目、八项判断由什么证据支撑,以及哪些问题当前仍不能从仓库证明。

Pass 1

从架构和全部一方包组 README 建立能力地图。

Pass 2

沿 Agent 主路径、治理路径和失败边界进入源码与测试。

反证

主动寻找 POC、非安全边界、不可恢复和协议限制。

证据方法

第一遍阅读架构总览包组地图以及 packages/ 下全部一方包组 README,回答“项目有哪些能力族、它们怎样组合”。第二遍沿 Agent 创建、模型请求、工具执行、会话持久化、客户端投影、subagent、workflow、sandbox 和多协议入口进入核心源码与测试,回答“真实任务怎样运行、失败时发生什么”。

vendor/ 是按清单同步的 Cordis 上游副本,不作为产品创新结论的独立来源;native/python/ 通过各自 README 和消费路径纳入覆盖。业务价值只在实现机制可以支撑时推导,市场收益、生产规模和行业完成度不从代码推测。

项目能力地图

项目区域主要职责蓝皮书中的位置
core/会话、提示词、工具、Agent 与 agent loop一次任务怎样运行
api/typert/远程 BFF、类型图、loader 和 RPC registry多界面共享类型化能力
llm/LLM Service Definition、目录、适配器和 DeepSeek 提供方能力 seam 与模型配置
shell/subprocess/terminal/命令、进程树和持久终端执行工具执行与环境约束
fs/lsp/文件能力、策略和语言服务器研发场景与文件治理
skill/web/skill 注册、目录、加载器、搜索和抓取知识作业场景
context/compaction/请求上下文和模型历史压缩长会话与可回放上下文
subagent/workflow/委派、可继续子 Agent 和动态工作流长任务协作与限制
todo/plan/goal/jobs/schedule/计划状态、目标、后台任务与定时执行可观察的任务推进
preset/bundle/boot/每会话组装、安装组合和应用启动一切皆插件与平台化
guard/interaction/循环卫生、超时、命令、权限、审批和询问工具治理与人工控制
session/持久化、投影、标题、遥测和查询恢复、回放与证据
settings/credentials/identity/用户设置、凭据引用和匿名身份配置治理与 secret 分离
client/host/浏览器运行时、UI 模组、Host 与 API 代理插件化业务界面
acp/sdk/python/自动化协议、JSON-RPC 与两种 SDK多种接入方式
hooks/extensions/外部工具桥接和运行时自修改生态接入与受信动态扩展
sandbox/e2b/code-runtime/文件限制、远程执行 POC 和脚本运行治理边界与当前限制
examples/support/util/可运行组合、测试设施和零依赖工具组装验证与工程支撑

八项创新的证据索引

结论主要源码或文档代表性测试证据置信度与限制
一切皆插件架构总览bundle 包组应用启动preset 挂载测试高;插件信任由部署组装决定
完整能力 seam能力 seam 规则LLM 包组E2B POC本地 sandbox 测试高;提供方安全属性不相同
模型所见可回放会话实现Agent loop请求重建测试会话属性测试高;合规保留策略不在日志内
工具治理流水线工具注册表审批服务工具行为测试审批测试高;只覆盖经工具注册表调度的动作
每会话 Agent 组装Agent preset 实现会话 preset 测试发现测试高;不是企业租户系统
长任务可观察协作subagent 包组workflow 包组continuation 测试workflow 集成测试高;动态 workflow 不跨重启恢复
多种接入方式ACPSDKPythonACP 轮次测试高;各协议只公开自己的子集
客户端插件图客户端模组Web 运行时模组 loader 测试conversation 测试高;领域 UX 仍需产品设计

关键主路径定位

Agent 与模型请求

Agent loop记录 turn/startstep/start、用户消息、流式 assistant 内容、工具调用与结束原因,并用 deriveMessages() 形成下一次请求。会话实现拥有事件追加、表层投影、格式加载、fork 和消息派生。

工具与批准

工具注册表声明 guard、执行阶段、结果和呈现意图。审批服务声明 ask/never、失败关闭和可回放审计事件。两者共同证明“模型提出调用”与“动作获准执行”是不同阶段。

会话组装与恢复

Agent preset拥有发现、解析、standing mount、重组限制和作用域服务读取。会话持久化提供写入、读取和准备路径;continuable subagent 在自己的会话中保存描述与委派策略。

界面与协议

Web 运行时从会话窗口构建 conversation 与 trajectory 投影。ACP公开更窄的自动化接口,只发送已提交 assistant 文本;SDK 通过 JSON-RPC 驱动同一 Agent 与会话服务。

用反证界定结论

如果发现以下事实会推翻或收窄哪项结论当前检查结果
模型可见内容没有对应会话事件“模型所见可回放”主请求路径要求先记录;未发现例外
工具可在 guard 拒绝后重新允许“治理流水线单调收紧”guard 类型没有 allow 分支
子 Agent 可以在无人观察时弹窗升权“委派权限固定”委派写入 approval/policy: never
动态 workflow 能在重启后续跑“当前无恢复”限制失效README 明确无 journal 或 resume
SandboxMode 同时限制网络与凭据“只表达文件效果”限制失效服务词汇明确排除网络、进程、syscall、设备与凭据

当前仓库不能证明什么

  • 不能证明某个行业已经拥有开箱即用的完整解决方案;仓库提供通用能力与示例组合。
  • 不能证明生产规模、可用性目标或单位经济性;需要目标部署的容量测试和账单数据。
  • 不能证明会话日志自动满足任何具体监管要求;合规解释依赖身份、存储和制度。
  • 不能证明任意模型生成代码可以安全运行;多个 worker/vm 实现明确不构成恶意代码安全边界。
  • 不能证明多 Agent 对所有任务都更快或更好;并行收益取决于任务可分解性、汇总和资源成本。
如何继续核验

从业务结论进入主路径,再读限制和测试

初学者先读“从任务到证据”;架构与平台评估者按本页索引进入 owner 包;安全评审者从“治理边界”反向检查部署条件。README 解释约定,源码确认实现,测试证明关键分支被持续执行。

证据状态:除特别标注外,本页基于当前 worktree 的源码、测试和文档已确认;未运行真实 DeepSeek API、生产负载或目标企业系统验证。