兰 亭 墨 苑
期货 · 量化 · AI · 终身学习
首页
归档
编辑文章
标题 *
URL 别名 *
内容 *
(支持 Markdown 格式)
# DeepSeek Harness 0.1.15:当 Agent 框架开始“自我进化” 2026 年 8 月 13 日,DeepSeek 在发布 V4-Pro 正式版的同时,开源了旗下首款 Agent 框架 **DeepSeek Harness**(命令行工具名 `dsh`),以 MIT 协议开放,支持商业使用和自由修改。上线仅数小时,该仓库便积累了超过 33,000 个 GitHub 星标,24 小时内突破 7 万。这一数字背后,反映的是开发者社区对“Agent 基础设施”这一命题的强烈关注。 截至 2026 年 9 月,Harness 已迭代至 **0.1.15** 版本。本文将系统介绍这一版本的核心特性、架构理念、实际表现,以及它在当前 Agent 工具生态中的位置。 --- ## 一、Harness 是什么:重新定义 Agent 的“运行系统” DeepSeek 官方给出了一个极简的公式:**Agent = Model + Harness**。 模型负责思考与推理,而 Harness 负责让模型“能干活”——工具调用、任务规划、执行调度、沙箱隔离、状态存储、上下文管理,所有让语言模型真正成为 Agent 的工程能力,都由 Harness 承载。 这与 Claude Code、Codex 等产品的定位有本质区别。后者是面向软件开发的“成品工具”,而 Harness 更接近一个**Agent 运行时的底层底座**。用一位开发者的比喻来说:Claude Code 是精装房,墙不能拆;Harness 则把施工图和预制件全部开源,开发者可以自由重组。 Harness 的核心理念是 **“一切皆插件”(Everything is a Plugin)** 。这不只是外挂扩展层面的插件化,而是字面意义上的彻底贯彻:模型适配器、工具注册表、会话日志、Agent 循环本身,全部以插件形式存在,每一个都可以被替换。官方文档明确写道:“不存在需要打补丁的特权核心,扩展 Harness 的方式就是把插件挂载到其他插件旁边。” --- ## 二、0.1.15 版本的核心能力 ### 1. 四种运行模式,覆盖不同场景 Harness 预置了四种运行模式,每种模式自动加载对应的插件集: * **标准模式**:功能完整的编码 Agent,涵盖文件编辑、Shell 访问、网页搜索、Skills、计划模式、目标追踪、子代理和工作流等全套能力。适合日常开发任务。 * **PTC 模式(Programmatic Tool Calling)**:在标准模式基础上,额外提供 Code Mode SDK。模型不再将工具作为独立函数调用,而是生成 TypeScript 程序来组合多步操作,将原本需要五次往返的调用压缩为单次执行。 * **极简模式**:仅保留两个工具——持久化 bash 和 `str_replace_editor` 文件编辑器。这一模式正是 DeepSeek V4-Pro 模型卡脚注中标注的、厂商运行代码智能体基准测试所用的 Agent 框架。它的存在意义在于提供最小化的可控环境,用于基准测试和问题复现。 * **创造模式**:在标准模式全部能力之上,额外提供运行时检查、Cordis 插件实验和预设编写指导。开发者可以用它来创建自定义 Agent 预设——相当于“用 Agent 造 Agent”。 ### 2. 仅追加式会话日志:让一切可回放、可复现 Harness 维护一份**仅追加写入的会话日志**,所有抵达模型请求的内容都必须能从该日志中还原。这意味着对话历史不再只是实现细节,而是恢复、分叉、回放、转录、遥测和 Web 界面等核心功能的单一事件流基础。 配套的 **Trajectory 视图**让开发者可以随时监控 Agent 的执行过程。与 Chat 视图呈现的润色后对话不同,Trajectory 展示的是原始事件级记录,包括系统提示词、思维链、工具调用与结果、子 Agent 调度及每次上下文注入。 ### 3. 严格的沙箱安全机制 Harness 在安全方面采取了多层次的防护措施。本地后端通过 Node 插件,将子进程分别封装在 Linux Landlock、macOS Seatbelt 或 Windows ACL 受限令牌运行器中。权限模式分为只读、工作区可写和完全访问三档,涉及高权限操作时 Web UI 会弹出审批请求。 ### 4. 不绑定 DeepSeek 模型 尽管由 DeepSeek 开发,Harness in 设计上并不与自家模型绑定。其提供商目录涵盖 Anthropic、OpenAI、AWS Bedrock、微软 Azure 以及 Google 的 Gemini Enterprise Agent Platform,同时也支持 DeepSeek 自身的接口端点,并可添加兼容 OpenAI 接口标准的自定义推理网关。 更具特色的是,Harness 附带两个子 Agent 提供商,可直接将任务委托给 Anthropic 的 Claude Code 和 OpenAI 的 Codex。 ### 5. 多模态支持的增强(0.1.x 版本更新) 在发布后的版本迭代中,Harness 增强了多模态支持。DeepSeek 模型适配器现在支持配置启用原生图片请求。作为配套改动,此前只能接纯文本的 `/goal`、`/plan` 等命令现在可以带图发送,`@` 的引用范围也从文件扩展到了历史会话。 --- ## 三、架构基石:Cordis 与“时空可组合性” Harness 的插件架构建立在 **Cordis** 元框架之上。Cordis 是一个“面向时空可组合性的元框架”,其设计理念来自 DeepSeek 与北京大学研究人员联合发表的论文《A Programming Paradigm for Spatiotemporal Composability》。 论文提出了一种新的编程模型:一个组件不仅需要告诉系统“我需要什么”,还需要明确“我会改变什么”。系统在运行时可以据此自动激活相应依赖,而当组件退出时,又能够撤销此前产生的影响。这种机制让插件的动态加载、卸载和依赖管理变得自动化和安全。 --- ## 四、实际表现:优势与短板 ### 优势 * **成本优势显著**:相比同类工具,API 调度与执行成本大幅降低。 * **可组合性极强**:一切皆插件,内置超百个插件。 * **可追溯性完善**:Trajectory 视图和仅追加式会话日志为调试和审计提供了完整支持。 * **上手门槛低**:通过 `npx @deepseek-ai/dsh web` 一条命令即可启动 Web UI。 ### 短板 * **版本不稳定**:当前仍处于开发者预览阶段(rc 系列),未来将出现破坏兼容性的变更。 * **文档仍在完善**:部分进阶能力需要翻阅源码或在社区中寻找答案。 * **暂时无法接受外部 PR**:官方目前建议通过 GitHub Discussions 交流或直接构建插件。 --- ## 五、与其他 Agent 框架的对比 | 维度 | DeepSeek Harness | Claude Code / Codex | |------|------------------|---------------------| | 定位 | Agent 运行时底座 | 成品开发工具 | | 架构 | 一切皆插件,核心可替换 | 模型与工具链深度绑定 | | 扩展方式 | 配置层替换任意组件 | Skill、MCP、Hooks 等外围扩展 | | 模型支持 | 多提供商,不绑定 DeepSeek | 绑定自家模型 | | 成本 | 显著更低 | 相对较高 | | 成熟度 | 开发者预览,快速迭代 | 生产级稳定 | --- ## 六、总结:Agent 时代的“安卓”雏形 DeepSeek Harness 0.1.15 的核心价值,不在于它当前的功能完备度,而在于它提出并实践了一种**彻底模块化的 Agent 架构范式**。 它将 Agent 运行所需的各个环节全部拆分为可动态组合的插件。从模型层向 Agent 基础设施层延伸,DeepSeek 的这一动作,或许标志着 AI 竞争正在从“谁家的模型更聪明”,转向“谁家的 Agent 更能干活”。而 Harness,正是这场转向中一个值得持续关注的开源基座。
配图 (可多选)
选择新图片文件或拖拽到此处
标签
更新文章
删除文章