Skip to content

源码证据与项目地图 ​

English | 中文

06SOURCE EVIDENCE

每项结论都应能回到源码、测试或明确限制

本页不是文件清单。它说明蓝皮书怎样覆盖项目、八项判断由什么证据支撑,以及哪些问题当前仍不能从仓库证明。

Pass 1

从架构和全部一方包组 README 建立能力地图。

Pass 2

沿 Agent 主路径、治理路径和失败边界进入源码与测试。

反证

主动寻找 POC、非安全边界、不可恢复和协议限制。

证据方法 ​

第一遍阅读架构总览、包组地图以及 packages/ 下全部一方包组 README,回答“项目有哪些能力族、它们怎样组合”。第二遍沿 Agent 创建、模型请求、工具执行、会话持久化、客户端投影、subagent、workflow、sandbox 和多协议入口进入核心源码与测试,回答“真实任务怎样运行、失败时发生什么”。

vendor/ 是按清单同步的 Cordis 上游副本,不作为产品创新结论的独立来源;native/ 与 python/ 通过各自 README 和消费路径纳入覆盖。业务价值只在实现机制可以支撑时推导,市场收益、生产规模和行业完成度不从代码推测。

项目能力地图 ​

项目区域主要职责蓝皮书中的位置
core/会话、提示词、工具、Agent 与 agent loop一次任务怎样运行
api/ 与 typert/远程 BFF、类型图、loader 和 RPC registry多界面共享类型化能力
llm/LLM Service Definition、目录、适配器和 DeepSeek 提供方能力 seam 与模型配置
shell/、subprocess/、terminal/命令、进程树和持久终端执行工具执行与环境约束
fs/ 与 lsp/文件能力、策略和语言服务器研发场景与文件治理
skill/ 与 web/skill 注册、目录、加载器、搜索和抓取知识作业场景
context/ 与 compaction/请求上下文和模型历史压缩长会话与可回放上下文
subagent/ 与 workflow/委派、可继续子 Agent 和动态工作流长任务协作与限制
todo/、plan/、goal/、jobs/、schedule/计划状态、目标、后台任务与定时执行可观察的任务推进
preset/、bundle/、boot/每会话组装、安装组合和应用启动一切皆插件与平台化
guard/ 与 interaction/循环卫生、超时、命令、权限、审批和询问工具治理与人工控制
session/持久化、投影、标题、遥测和查询恢复、回放与证据
settings/、credentials/、identity/用户设置、凭据引用和匿名身份配置治理与 secret 分离
client/ 与 host/浏览器运行时、UI 模组、Host 与 API 代理插件化业务界面
acp/、sdk/ 与 python/自动化协议、JSON-RPC 与两种 SDK多种接入方式
hooks/ 与 extensions/外部工具桥接和运行时自修改生态接入与受信动态扩展
sandbox/、e2b/、code-runtime/文件限制、远程执行 POC 和脚本运行治理边界与当前限制
examples/、support/、util/可运行组合、测试设施和零依赖工具组装验证与工程支撑

八项创新的证据索引 ​

结论主要源码或文档代表性测试证据置信度与限制
一切皆插件架构总览、bundle 包组、应用启动preset 挂载测试高;插件信任由部署组装决定
完整能力 seam能力 seam 规则、LLM 包组、E2B POC本地 sandbox 测试高;提供方安全属性不相同
模型所见可回放会话实现、Agent loop请求重建测试、会话属性测试高;合规保留策略不在日志内
工具治理流水线工具注册表、审批服务工具行为测试、审批测试高;只覆盖经工具注册表调度的动作
每会话 Agent 组装Agent preset 实现会话 preset 测试、发现测试高;不是企业租户系统
长任务可观察协作subagent 包组、workflow 包组continuation 测试、workflow 集成测试高;动态 workflow 不跨重启恢复
多种接入方式ACP、SDK、PythonACP 轮次测试高;各协议只公开自己的子集
客户端插件图客户端模组、Web 运行时模组 loader 测试、conversation 测试高;领域 UX 仍需产品设计

关键主路径定位 ​

Agent 与模型请求 ​

Agent loop记录 turn/start、step/start、用户消息、流式 assistant 内容、工具调用与结束原因,并用 deriveMessages() 形成下一次请求。会话实现拥有事件追加、表层投影、格式加载、fork 和消息派生。

工具与批准 ​

工具注册表声明 guard、执行阶段、结果和呈现意图。审批服务声明 ask/never、失败关闭和可回放审计事件。两者共同证明“模型提出调用”与“动作获准执行”是不同阶段。

会话组装与恢复 ​

Agent preset拥有发现、解析、standing mount、重组限制和作用域服务读取。会话持久化提供写入、读取和准备路径;continuable subagent 在自己的会话中保存描述与委派策略。

界面与协议 ​

Web 运行时从会话窗口构建 conversation 与 trajectory 投影。ACP公开更窄的自动化接口,只发送已提交 assistant 文本;SDK 通过 JSON-RPC 驱动同一 Agent 与会话服务。

用反证界定结论 ​

如果发现以下事实会推翻或收窄哪项结论当前检查结果
模型可见内容没有对应会话事件“模型所见可回放”主请求路径要求先记录;未发现例外
工具可在 guard 拒绝后重新允许“治理流水线单调收紧”guard 类型没有 allow 分支
子 Agent 可以在无人观察时弹窗升权“委派权限固定”委派写入 approval/policy: never
动态 workflow 能在重启后续跑“当前无恢复”限制失效README 明确无 journal 或 resume
SandboxMode 同时限制网络与凭据“只表达文件效果”限制失效服务词汇明确排除网络、进程、syscall、设备与凭据

当前仓库不能证明什么 ​

  • 不能证明某个行业已经拥有开箱即用的完整解决方案;仓库提供通用能力与示例组合。
  • 不能证明生产规模、可用性目标或单位经济性;需要目标部署的容量测试和账单数据。
  • 不能证明会话日志自动满足任何具体监管要求;合规解释依赖身份、存储和制度。
  • 不能证明任意模型生成代码可以安全运行;多个 worker/vm 实现明确不构成恶意代码安全边界。
  • 不能证明多 Agent 对所有任务都更快或更好;并行收益取决于任务可分解性、汇总和资源成本。
如何继续核验

从业务结论进入主路径,再读限制和测试

初学者先读“从任务到证据”;架构与平台评估者按本页索引进入 owner 包;安全评审者从“治理边界”反向检查部署条件。README 解释约定,源码确认实现,测试证明关键分支被持续执行。

证据状态:除特别标注外,本页基于当前 worktree 的源码、测试和文档已确认;未运行真实 DeepSeek API、生产负载或目标企业系统验证。