![]()
8月14日凌晨,AI圈内被DeepSeek两条连续消息刷屏。先是官方宣布DeepSeek-V4-Pro正式版上线,同时放出API即将涨价的通知;仅仅两小时之后,DeepSeekHarnessv0.1开发者预览版正式公测、同步开源。
这套紧凑的“闪电二连击”瞬间引爆海内外开发者社区。项目上线半小时,GitHub仓库星标突破一万,短短时间内已经冲破3万。很多内测开发者纷纷晒出体验感言与内测合影,期待已久的产品终于浮出水面。但上手之后不少人发现:它和大众提前猜想的产品形态完全不同,这不是一款面向普通用户的CodingAgent,而是一套自由度极高的Agent底层开发框架。
![]()
![]()
DeepSeekHarness负责人崔添翼也在社交平台坦诚,当前只是预览版本,诸多细节仍显粗糙,欢迎全球开发者参与测试、提出优化意见。当很多人拿着ClaudeCode的标准期待它时,DeepSeek拿出了一套思路截然不同的技术底座。
一、打破预期:不走PiAgent路线,核心是“一切皆插件”
在正式发布前,社区对DeepSeekHarness有不少猜测。很多开发者预判产品会沿用PiAgent架构,或是搭载DeepSeek引以为傲、缓存表现亮眼的Reasonix组件。但最终亮相的版本,选择了一条完全独立的技术路线。
整套框架最核心的设计理念,概括起来就是一切皆插件。
![]()
模型接入、工具调用、技能逻辑、会话管理、沙箱环境、数据存储、任务循环调度,甚至前端UI界面、子Agent调度模块,全部封装为独立插件。开发者能够自由替换、按需重组,不用被固定架构束缚。
支撑这套设计的底层是Cordis元框架。简单理解,Cordis只负责插件的加载、卸载、处理组件之间的依赖关系,本身不承载任何业务功能。所有具备实际能力的模块,全部以插件形式运行。这套元框架理念,来自北京大学与DeepSeek联合发布的论文《AProgrammingParadigmforSpatiotemporalComposability》。
也正是这个架构设计,让开发者迅速分清边界:DeepSeekHarness定位是框架,而非开箱即用的智能应用。
![]()
市面上常见的代码智能体,是厂商预先封装好完整流程,用户只能有限拓展;而Harness更像一套标准化的组装平台,开发者基于底座,自行搭建想要的各类Agent。
仓库与配套论文链接已经公开,开发者拉取源码就能本地部署,门槛并不算高。
部署完成后打开本地地址,填入DeepSeekAPIKey即可进入操作页面。界面整体风格简洁,和DeepSeek网页端相近,最明显区别是页面标志性鲸鱼图标改为黑色。左侧管理对话,右侧提供模式切换与输入框,设置栏可以自由开启、关闭各类插件,没有多余繁杂功能。
![]()
二、四种运行模式,适配从测试到创新各类场景
依托插件体系,DeepSeekHarness内置四种运行模式,每种模式默认搭载不同插件组合,面向不一样的使用场景。
标准模式:配备完整工具插件组合,适合处理翻译、文档处理、复杂多步骤任务,也是日常测试最常用的模式;
PTC(程序化工具调用)模式:支持模型生成代码,串联多轮工具调用,擅长需要连续执行多项操作的工程任务;
极简模式:仅保留Shell工具、文件编辑工具,剔除所有多余组件。主要用于纯净环境下的模型基准测试,杜绝额外因素干扰评测结果;
创造模式:允许开发者实时检测运行环境,在内存中调试Cordis插件,基于现有组件组合创造全新运行模式。
框架还有一个很受工程师好评的特色设计——完整运行轨迹记录。
系统采用仅追加模式存储会话日志,模型接收的提示词、思维链、每一次工具调用、返回结果、子Agent调度行为、上下文注入信息全部留存。界面上彩色进度条对应每一段执行节点,点击即可查看完整过程,支持任务恢复、分支复刻、检索回放。不管是调试报错,还是复盘Agent任务执行逻辑,都清晰直观。
![]()
![]()
三、实地上手实测:文档翻译、小游戏开发表现直观
不少媒体第一时间拉取源码完成本地部署,在标准模式下进行实测。测试任务正是底层Cordis框架那篇88页论文全文翻译。
初次启动时,PDF解析工具需要在线安装。运行过程中Harness主动扫描本地文件,识别到一份旧版翻译文档,主动建议在原有文稿基础上补充修订,避免重复工作。
![]()
整个任务流程拆分合理,自动派发10个子代理分工修改、校对、补全内容。最终产出文档格式规整,术语保持统一。整套88页论文翻译耗时22分钟,首Token平均响应速度1.4秒,缓存命中率达到98%。所有工具调用、子代理执行步骤,都能在轨迹视图逐条追溯。
![]()
另外两组简单测试也能看出模式之间明显差异。使用框架编写贪吃蛇小游戏:极简模式50余秒完成代码输出,但生成代码需要在Python环境运行,不会额外封装HTML页面;PTC模式耗时1分05秒,输出内容完整性更高。
![]()
二者的差别印证极简模式的定位:追求极致精简,不会执行任何任务之外的多余操作,非常适合模型性能基准对比。
四、闭源提供现成产品,开源把未来交到开发者手上
体验过后不难得出结论:DeepSeekHarness短期内不会成为普通用户日常使用的工具。它面向的核心人群,是全球AI开发者、Agent项目创作者。
对普通使用者而言,它上手门槛更高,需要基础开发环境、掌握简单部署命令;但对于深耕智能体赛道的工程师,这套开源框架拥有极强的可塑性。大家可以根据需求自由拼装组件,打造代码Agent、自动化工作流、行业专用智能体,相当于一套可供自由改造的“乐高底板”。
客观来看,v0.1预览版生态还处在起步阶段,插件数量、交互体验仍有很大优化空间。不过开源策略,让它拥有持续进化的潜力。
市面上很多主流智能体产品采用闭源方案,厂商提供成熟可用的服务,但底层架构黑盒化,用户很难深度修改。DeepSeek选择另一条路线:模型能力由官方持续迭代,同时开放Agent运行底座,允许社区自主拓展、二次改造。
业内常说一句话:闭源产品给用户当下可用的能力,开源框架把未来的可能性交给开发者。
伴随着V4-Pro正式版更新与调价公告同步放出,DeepSeek的布局方向也愈发清晰。一边持续打磨大模型推理能力,完善商业化服务体系;另一边打通模型之外的执行层,搭建开源Agent生态底座,补齐从“大模型推理”到“智能体落地”关键一环。
现在谈论DeepSeekHarness能否对标海外成熟Agent产品还为时过早。作为刚亮相的预览版本,稳定性、配套生态都需要时间持续完善。
但它的出现代表一个明确信号:国内大模型厂商竞争,已经不再局限于模型跑分、API价格比拼,竞争延伸到上层Agent运行框架。
当越来越多开发者基于这套Cordis插件体系搭建项目,围绕框架形成插件社区,DeepSeek将不再只依靠模型本身吸引用户。模型是智能体的大脑,而Harness,就是让大脑真正动手完成复杂任务的整套执行系统。未来一段时间,这套开源底座会衍生出哪些创意项目,值得整个开发者社区持续观察。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.