铭鸿体育资讯网

5天800个提交!DeepSeekHarnessv0.1.6发布:8项重点功能拆解

AI 现在会想了,但真到干活这一步,很多时候还是得你自己点浏览器、切终端、连服务器。 DeepSeek Harnes
AI 现在会想了,但真到干活这一步,很多时候还是得你自己点浏览器、切终端、连服务器。


DeepSeek Harness 这次更新,就是冲着“把执行入口补齐”来的,动作不小,但别急着当成全都能直接上手。

9 月 15 日,官方放出了 v0.1.6-alpha.1。


它和 9 月 10 日的 v0.1.5-rc.2 相比,GitHub Compare 显示中间差了 800 个提交。注意,这说的是代码提交,不是 800 个新功能,里面有功能、修复、测试、文档和合并记录,别看数字就上头。

这次最值得看的,是新增了一堆“能真正动手”的入口。


比如浏览器操作、电脑操作、SSH 远程执行、内置终端,还有更适合自动化的 Headless。

但先把版本号记牢:这是 Alpha 预发布版。


也就是说,有些能力已经进了主界面,有些还得单独装、单独配,不是升级完就自动全开。

先说 Browser Use,也就是浏览器操作。


这版接了三套实验性后端:Playwright MCP、Chrome DevTools MCP、Stagehand。

官方的思路很清楚,任务规划和执行循环还是由 DSH 负责,浏览器后端只负责“帮你点、帮你输、帮你跳转”。


换句话说,Agent 不只是能“搜网页、读网页”了,还开始往真正操作网页走。

这里有个挺实用的设计。


它既能启动新浏览器,也能附加到已有浏览器。

拿 Chrome DevTools MCP 举例,launch 模式会直接拉起浏览器;attach 模式则要你先配好已有浏览器的调试端点,才能接管现成标签页和登录状态。


所以,别误会成“我电脑上随便开个浏览器,它就能直接接管”。

保留登录状态是有前提的。


我的建议很简单:先拿独立测试浏览器跑流程。

尤其是后台管理、提交表单、账户操作这些事,先确认它到底点了哪儿、输了什么,再考虑放大使用范围。

第二项是 Computer Use,也就是计算机操作。

官方加了 Cua Driver 的 MCP 和原生两条实验路线,主要拿来做本机操作和截图。

这部分也得显式配置,能不能用、能用到什么程度,还得看驱动和部署环境。

这两项一加,DSH 的动作范围就不只是文件、命令、网页信息了。

它开始能碰浏览器界面和本机桌面。

但有个边界一定要记住:取消任务,不等于撤销已经做出去的操作。

点过的按钮、输过的内容、跳过的页面,不会因为你按了停止就自动回滚。

第三项是 SSH 远程工作区。

这个功能挺适合“本地跑 Harness,项目却放在远程服务器上”的场景。

官方的设计是,本地保留模型调用、权限管理、Session 持久化这些职责,然后通过 SSH 去用远端的文件、进程和执行环境。

好处就是,不用为了操作远程项目,把整套 Harness 和会话数据都搬过去。

听起来很美,但先别理解成“填个服务器地址就能完整远程开发”。

目前初始集成范围还是 POSIX 环境下的 Headless 和自定义配置组合,还要准备远端辅助程序。

更广泛的 Web 工作区集成,还在后面。

第四项是 Web Terminal,网页内置终端。

这个就很容易让人有感觉了。

Web 侧边栏直接加了终端,支持多标签、Shell 选择,还能在页面刷新后恢复。

对拿 DSH 做项目的人来说,实用场景特别直接。

Agent 改完文件,你可以顺手在旁边终端里检查。

想跑测试就跑测试,想构建就构建。

一个标签看开发服务,一个标签跑测试,一个标签查 Git,切窗口的次数都少了。

不过这里也别过度理解。

“页面刷新后恢复”不等于“电脑重启后原来的程序还能接着跑”。

官方承诺的是前者,不是后者。

第五项是 Headless,无界面运行增强。

这次给了三个关键入口,明显更方便脚本和自动化程序来驱动 DSH。

如果你已经准备好了新版运行环境、模型配置和测试项目,可以先拿一个简单任务试试看。

这里要注意,提示词只是在表达任务要求。

它不替代文件权限,也不替代沙箱设置。

另外,`--json` 输出里能区分会话、状态、正文、推理、工具调用、工具结果和最终答案。

外部程序终于能知道“它现在在干什么”,不必死等最后一句。

但这块也有两个容易忽略的限制。

第一,`--session-id` 不是万能接力棒。

它要求已有持久化会话,还会检查工作目录等条件;子代理会话、Fork 会话,以及用了不匹配 Agent Preset 的会话,可能会被拒绝续接。

第二,JSON 模式里的正文和推理,不是逐 Token 实时吐出来的。

它是在步骤提交后输出。

所以自动化程序别只盯着 final,还得看进程退出码和轮次结束原因,不然很容易误判成功。

我个人觉得,这功能对定时检查、批处理、开发流水线的价值,可能比单纯多一个聊天按钮更大。

第六项是 MCP 资源能力。

这版除了升级 MCP SDK,还支持资源发现、资源读取和 URI Template,也把协议协商、工具分页、没有工具的服务器支持补得更完整了。

刚接触的话,可以这么分。

Tool 更像“帮我做个动作”;Resource 更像“这里有份内容,你给我读一下”;URI Template 则是告诉你,怎么通过参数找到某类资源。

但具体能读到什么,还是得看你连的 MCP 服务给了啥。

别以为 DSH 一接上,就自动拿到了所有外部资料。

第七项是归档会话恢复。

设置里多了已归档会话列表,能查看,也能恢复。

这等于给“先收起来的会话”留了个找回入口。

但要说清楚,这只是归档恢复,不是删文件后的数据恢复工具。

第八项是实验性 Auto Review,也就是自动审核。

它会在受支持的工具调用执行前,先用当前 Agent 的模型审一遍,决定放行还是拒绝。

每做一次这样的审查,都会多一次模型请求,Token 也会跟着涨。

这个功能最要命的点在于:

被放行的调用,是按 Full access 执行的。

它没有文件沙箱,模型也可能误放行危险动作,或者把正常操作误拒了。

所以它适合研究“怎么少一点人工审批”,

但现在绝对不能当成“开了就能放心无人值守”的安全保障。

第一次试,最好拿能丢的测试项目上,别直接连重要账户或生产环境。

这次还有几个修复也挺关键。

比如按轮次 Fork 时,不再错误带入后续输入和设置。

可选插件启动失败后,其他可用插件还能继续跑;必需插件失败才会退出。

子代理完成通知也改成只传正文,避免推理块把父会话的 Messages 请求搞挂。

这些修复不能说是“历史问题一把清空”,

但至少确实解决了几类老毛病。

升级前,还有几处配置变化得盯紧。

DeepSeek 适配器默认改用 Messages 协议,还支持通过 Files API 复用已上传图片。

如果你手动覆盖过旧官方根地址,需要按说明处理一下,或者改成新的地址方式。

但其他第三方 Provider 地址,别跟着乱改。

另外,Ralph 默认关了,内置 E2B 后端也移除了,PTC 包和服务统一到 `ptc-runtime` 系列,工作流执行器改成了 `workflow-ptc`。

依赖这些旧名字的自定义配置,都得回头检查。

实验性 Team 模式也变了,统一用 `spawn_teammate`,默认队友创建上限从 8 提到了 16。

注意,这说的是默认上限,不是说能永远同时跑 16 个 Agent。

还有一点容易被忽略。

这版里,相应 DeepSeek 适配器请求路径会默认启用会话日志贡献,通过 `dsh_session_log` 字段发送还没确认接收的会话事件。

里面可能包含消息文本、工具参数和结果、工作区路径、反馈。

这个字段不会进模型 messages,所以不增加模型输入 Token,也不改变模型可见缓存前缀。

但它照样会跟着 HTTP 请求发出去。

所以别把“不占 Token”理解成“数据只留在本地”。

如果不想开,可以显式关掉。

按官方配置叠加机制,可以新建一个 `privacy.patch.yml`,先检查合成配置,不启动应用,确认目标项 `enabled` 是 `false`,再带着同一份补丁启动。

如果想长期保留,就把对应配置并进 DSH Home 下的 `cordis.patch.yml`,别整份覆盖。

另外,这条日志链和 OTel 遥测是两回事。关了遥测,不等于关了会话日志贡献;关了日志贡献,也不等于停掉正常模型 API 请求。

简单总结一下,这次 800 个提交带来的最大变化,就是 DSH 的执行入口明显变多了。

但“功能已经加上”和“日常使用已经成熟”,还是两回事。

我的建议是:先试 Web Terminal、归档恢复和 Headless,再碰浏览器、电脑和远程执行。

Auto Review 放最后,先看清它的权限和成本。

升级前记得先备份整个 DSH Home,准备项目副本,再测试新版本。

你觉得这波更新里,最实用的是终端、Headless,还是浏览器/远程执行?

欢迎在评论区说说你的看法。