昨晚刷推的时候看到 DeepSeek 放了个新项目出来,叫 DeepSeek Harness(代号 dsh),MIT 协议,GitHub 地址在这:
dsh
https://github.com/deepseek-ai/deepseek-harness
一晚上快 4 万星了,热度离谱。
但让我觉得值得发帖聊的不是 star 数,是它的架构思路跟目前主流的 Agent 框架都不太一样。
现在大部分 Agent 框架(Claude Code、Cursor 之类的)都是单体架构:核心引擎写死了,模型调用、工具系统、Agent Loop 全在内部,你就只能在它给的接口处做扩展。想改 Agent Loop?不行。想换会话日志格式?不行。不满意只能 fork,然后永远跟不上上游。
DeepSeek Harness 反着来。它没有"核心引擎"这个概念,所有东西都是插件:
Agent Loop 本身都能换掉,换成你自己的实现,其他什么都不用改。
这思路跟主流完全不一样。
来自北大和 DeepSeek 联合发的一篇论文,名字叫《A Programming Paradigm for Spatiotemporal Composibility》。
干了几件事:
插件向共享上下文注册服务。模型插件注册 ctx.llm,工具插件注册 ctx.tools,互相不用 import,通过上下文拿。插件之间靠类型化事件通信,agent/pre-step、tools/pre-execute 这些事件,想拦截某个行为就监听对应事件,不用改源码。
ctx.llm
ctx.tools
agent/pre-step
tools/pre-execute
最重要的是可逆副作用。插件卸载时自动回滚所有注册,服务移除、监听取消、资源清理。这意味着插件可以热插拔,Agent 跑着的时候动态加载卸载,不用重启。
之前一直有人说插件化在 Agent 场景太重太慢,Cordis 这套至少证明了能做,而且做得还行。
一行命令:
npx @deepseek-ai/dsh web
浏览器打开 127.0.0.1:3080,填个 API Key 就能用了。需要 Node.js 22 以上。
127.0.0.1:3080
源码跑也行:
git clone https://github.com/deepseek-ai/deepseek-harness.git cd deepseek-harness pnpm install pnpm run build pnpm dsh web
还有个 Headless 模式,可以塞进 CI/CD:
dsh --profile headless "run the tests and summarize failures"
运行中切模式不用重启,热插拔的好处。
支持 Anthropic、OpenAI、AWS Bedrock、Google Vertex、Azure,以及任何 OpenAI 兼容端点,将近 40 家 provider。
今天用 DeepSeek 跑,明天换 Claude,会话记录和工具配置都不用动。这点比较良心。
说白了还是预览版,官方自己都说了会有破坏性变更。Bug 报告走 Discussions 不走 Issues,Releases 页面连个稳定版本都没有。
跟 Claude Code 比,Claude Code 是成熟产品,开箱即用。dsh 现在更像是个框架底座,给你建造工具,不是成品。普通开发者想找个好用的 Coding Agent,Claude Code 暂时还是更稳。
但如果你在做 Agent 相关的开发,需要深度定制,或者对现有框架的"死板"忍了很久,这个项目值得花时间看看。
团队负责人叫崔添翼,6 枚 ACM 金牌,在 Jane Street 干了九年,今年 3 月加入 DeepSeek。量化出身的人做框架,对可组合性的理解确实不太一样。
社区内测期间已经有大概 300 个插件了,GitHub Topics 搜 dsh-plugin 能找到。
dsh-plugin
反正 MIT 协议,不要钱,有兴趣的可以跑起来玩玩。
有没有兄弟已经在试了?聊聊体验?
国内企业:既然开源了就赶紧拿,拿来就是咱们的了!
只是一种更有特点的“毛坯房”,精装修还得自己动手......
我的天,6 枚 ACM 金牌
Featured Collection
Popular Events
DeepSeek 昨晚开源了个 Agent 框架,思路挺不一样的,聊一聊
昨晚刷推的时候看到 DeepSeek 放了个新项目出来,叫 DeepSeek Harness(代号
dsh),MIT 协议,GitHub 地址在这:https://github.com/deepseek-ai/deepseek-harness
一晚上快 4 万星了,热度离谱。
但让我觉得值得发帖聊的不是 star 数,是它的架构思路跟目前主流的 Agent 框架都不太一样。
核心就一句话:一切皆插件
现在大部分 Agent 框架(Claude Code、Cursor 之类的)都是单体架构:核心引擎写死了,模型调用、工具系统、Agent Loop 全在内部,你就只能在它给的接口处做扩展。想改 Agent Loop?不行。想换会话日志格式?不行。不满意只能 fork,然后永远跟不上上游。
DeepSeek Harness 反着来。它没有"核心引擎"这个概念,所有东西都是插件:
Agent Loop 本身都能换掉,换成你自己的实现,其他什么都不用改。
这思路跟主流完全不一样。
底层框架叫 Cordis
来自北大和 DeepSeek 联合发的一篇论文,名字叫《A Programming Paradigm for Spatiotemporal Composibility》。
干了几件事:
插件向共享上下文注册服务。模型插件注册
ctx.llm,工具插件注册ctx.tools,互相不用 import,通过上下文拿。插件之间靠类型化事件通信,agent/pre-step、tools/pre-execute这些事件,想拦截某个行为就监听对应事件,不用改源码。最重要的是可逆副作用。插件卸载时自动回滚所有注册,服务移除、监听取消、资源清理。这意味着插件可以热插拔,Agent 跑着的时候动态加载卸载,不用重启。
之前一直有人说插件化在 Agent 场景太重太慢,Cordis 这套至少证明了能做,而且做得还行。
怎么跑
一行命令:
浏览器打开
127.0.0.1:3080,填个 API Key 就能用了。需要 Node.js 22 以上。源码跑也行:
还有个 Headless 模式,可以塞进 CI/CD:
四种模式
运行中切模式不用重启,热插拔的好处。
不绑定 DeepSeek 模型
支持 Anthropic、OpenAI、AWS Bedrock、Google Vertex、Azure,以及任何 OpenAI 兼容端点,将近 40 家 provider。
今天用 DeepSeek 跑,明天换 Claude,会话记录和工具配置都不用动。这点比较良心。
现阶段的问题
说白了还是预览版,官方自己都说了会有破坏性变更。Bug 报告走 Discussions 不走 Issues,Releases 页面连个稳定版本都没有。
跟 Claude Code 比,Claude Code 是成熟产品,开箱即用。dsh 现在更像是个框架底座,给你建造工具,不是成品。普通开发者想找个好用的 Coding Agent,Claude Code 暂时还是更稳。
但如果你在做 Agent 相关的开发,需要深度定制,或者对现有框架的"死板"忍了很久,这个项目值得花时间看看。
一个细节
团队负责人叫崔添翼,6 枚 ACM 金牌,在 Jane Street 干了九年,今年 3 月加入 DeepSeek。量化出身的人做框架,对可组合性的理解确实不太一样。
社区内测期间已经有大概 300 个插件了,GitHub Topics 搜
dsh-plugin能找到。反正 MIT 协议,不要钱,有兴趣的可以跑起来玩玩。
有没有兄弟已经在试了?聊聊体验?