DeepSeek Harness - 核心架构模块与技术解析

深入解密 DeepSeek Harness 智能体执行基础设施、Cordis 插件内核架构、Trajectory 全轨迹追溯体系与 4 种 Agent 预设运行模式。

DeepSeek Harness 架构深度解密

在 AI 智能体(Autonomous Agents)设施建设与工程落地的演进进程中,DeepSeek 提出了标志性的底层设计哲学:

$$\text{Agent} = \text{Model} + \text{Harness}$$


为什么提倡 Agent = Model + Harness

在智能体开发实践中,我们需要清晰划分“推理大脑”与“工程脚手架”的职责边界:

  1. Model(推理大脑):负责认知理解、逻辑推演与 Token 序列预测。模型是 Agent 的灵魂,但单独的基座模型本质上是“悬空的大脑”,无法操控本地文件系统、执行 Shell 命令或捕获真实编译环境报错。
  2. Harness(工程脚手架与神经手脚):包裹在模型外层的系统工程架构。它赋予 Agent 理解环境、操控工具、持久化会话记忆并在真实场景中持续工作的工程能力。
  3. Agent(自主智能体系统):高性能 Model 与轻量解耦 Harness 结合后产生的端到端生产级自动化系统。
mermaid
graph TD
    subgraph ModelLayer["Model Layer (Reasoner & Brain)"]
        LLM[Base DeepSeek LLM]
    end

    subgraph CordisKernel["Cordis Kernel (Plugin & Dependency Router)"]
        Kernel[Cordis Core Engine]
    end

    subgraph CapabilityPlugins["Capability Plugins (Fully Decoupled)"]
        ModelPlugin[Model Interface Plugin]
        ToolPlugin[Tool & Skill Plugins]
        LogPlugin[Trajectory & Log Plugins]
        SandboxPlugin[Sandbox & Execution Plugins]
        UIPlugin[Web UI & Scheduler Plugins]
    end

    ModelLayer <---> ModelPlugin
    CordisKernel ---> CapabilityPlugins
    CapabilityPlugins ===> Agent[DeepSeek Harness Agent System]

核心架构设计哲学:一切皆插件 (Everything is a Plugin)

DeepSeek Harness 基于 Cordis 插件系统 构建:

  • Cordis 极简内核:内核只专注于插件的加载、卸载、生命周期回调与服务依赖注入,绝不硬编码任何具体 Agent 的业务逻辑。
  • 能力完全插件化:模型接入、工具集、Skill 技能库、会话日志、物理沙箱、向量存储、循环调度以及前端 UI 界面,全由可插拔组件提供。
  • 服务与事件通信:各插件之间通过标准的 Cordis 服务接口与事件发布/订阅机制彼此协作。
  • 配置层自由组合:开发者无需修改 DeepSeek Harness 任何源码,只需在配置文件层便可自由选择、替换或扩展任一能力。

三大工程设计亮点

1. 彻底解耦的 Cordis 插件体系

打破传统 Agent 框架将多步流程硬编码在 Python 脚本或类中的羁绊。能力全部解耦为标准化插件,使团队能够快速接入自定义工具链或全新的模型接口。

2. 每一次运行都有迹可循 (Trajectory Tracking)

模型看到和执行的一切(系统提示词、思维链 <think>、工具调用指令与返回值、子 Agent 调度及每一次上下文注入)全量写入仅追加(Append-Only)设计的会话日志中。

  • Trajectory 视图:按来源清晰拆解查看输入、输出与上下文注入轨迹。
  • 共享事件流:会话的恢复(Restore)、分支分叉(Fork)、语义检索(Search)与历史回放(Replay)共享同一份标准事件流,确保极高的调试透明度与工程可复现性。
mermaid
sequenceDiagram
    autonumber
    participant User as User / Web UI
    participant Harness as Cordis Harness Engine
    participant Model as LLM (Reasoner)
    participant Log as Trajectory Append-Only Log
    participant Sandbox as Execution Sandbox

    User->>Harness: 提交任务指令
    Harness->>Log: 写入用户 Prompt Event
    Harness->>Model: 发起上下文与提示词请求
    Model-->>Harness: 返回思考链与工具调用指令
    Harness->>Log: 追加 Model Response & CoT Event
    Harness->>Sandbox: 派发工具指令至沙盒执行
    Sandbox-->>Harness: 返回 Shell/Edit 运行结果
    Harness->>Log: 追加 Tool Result Event
    Harness-->>User: 渲染 Trajectory 轨迹视图

3. 多种预设运行模式 (4 Preset Modes)

  1. 标准模式 (Standard Mode):功能完整的编码 Agent,支持文件增删改查、Shell 命令执行、网页与文件检索、Skills 技能包、任务计划与子代理工作流。
  2. PTC 模式 (Programmatic Tool Calling Mode):基于 Code Mode SDK 将工具呈现给模型,允许模型编写一段 TypeScript 程序高效表达多步工具调用与条件循环。
  3. 极简模式 (Minimal Mode):仅保留持久 bash 终端与 str_replace_editor 的双工具 Agent,为纯粹的模型基准评估剔除一切干扰。
  4. 创造模式 (Creative Mode):允许开发者在内存中实时试验 Cordis 插件,检查当前运行时并自由组合创作全新的 Agent 预设。

快速体验与开发者指南

1. Web UI 一键启动 (npx)

只需在 Node.js 环境下运行以下命令,即可在一秒内调起浏览器 Web UI 界面:

bash
npx @deepseek-ai/dsh web

2. 源码克隆与开发环境准备 (git clone)

bash
# 克隆官方 GitHub 仓库
git clone https://github.com/deepseek-ai/deepseek-harness

# 进入项目根目录
cd deepseek-harness

探索 DeepSeek Harness 智能体基础设施

理解 Agent = Model + Harness 哲学,体验一切皆插件的开放 Agent 基础设施。