bml.asia · 纯文字 · 写写停停

DeepSeek Harness 最近的动作:桌面版落地与插件洪水

这一个月里我把 DeepSeek 的仓库翻了几遍,其中 Harness 这条线最值得单独记一笔。8 月 13 日它以 v0.1 开发者预览的形式开源,协议选了 MIT,12 小时 GitHub 星标破 5 万,一周冲到 16 万。热度参考价值有限,真正说明问题的是退潮后的 9 月,而最实在的一步是桌面版落地。命令行时期的 Harness 对开发者都不算友好,配 Node 环境、拉 profile、写 patch,光把界面点开就得绕一圈;桌面版把这些都收进去,安装是傻瓜式的,模型和 key 一键接入,报错也能读了,没选工作区、忘了填 key 这类问题会直接摆出来,而不是只丢一句失败。功能不变,价值在别处,它把“能跑起来”这件事交还给了只想用的人。毛病也还在,手机与电脑的联动有人试过,配对折腾半天一条消息都没发出去,但门槛这一层总算被处理了。

紧接着的 v0.1.5 把重点挪到了界面。这一版的 Web 端在左右两侧各开出一个标准化插件入口,左侧让插件在新建会话和工作区之间挂全局入口;右侧留给插件注册新的 Tab 类型和内容页面,用多标签、分栏、全屏来展示内容;图片和 PDF 能直接上传,右侧文件树可就地预览常见文档与代码。它想做的已经不只是给 Agent 装工具,而是给插件留画布,官方还提到后续会补上内置的插件管理面板。另一半变化在模型侧,新版本与 V4.1 Flash 深度结合,标准模式、程序化工具调用模式和极简模式都做过专项训练,还能在不废掉 KV Cache 的情况下改系统提示词,新会话默认就走这个模型;子 Agent 补得最细,父子之间能双向通信,任务跑到一半可以补信息、调方向,你能排队发消息、插话叫停,主 Agent 还能替子 Agent 挑模型和推理强度,实验性的 Agent Teams 默认关着,要自己把插件加进 profile,多出来的 token 消耗也得自己扛。外场的热闹程度不输版本号,社区市场几乎一周一变,有的站点 9 月 2 日已收录 5700 多个插件,还有站点喊到上万;另一类做法更值得看,有人把几百个插件逐个拉下来按七项结构复核,筛掉跑不起来的那批。8 月那几天插件仓库从 700 多冲到近 8000,6 天走完发布、爆火、分化、洗牌一整轮,一切皆插件的代价也在这儿,自由度越大信噪比越差,装之前先看源码和协议,会慢慢变成一项基本功。

另一头的价格把这件事推得更远。9 月 10 日起生效的新价目表里,缓存命中的输入降到每百万 tokens 两分钱,闲时输出每百万 tokens 四块钱,这两个数字都出在 deepseek-flash 这一档,而 v4-pro 的同一项是一毛五和十三块五;更关键的是路由,9 月 14 日中午 12 点之后,发往 v4-pro 的请求会全部转到 V4.1 Flash 并按 Flash 的单价计费,原来按名字区分的那几档模型,界线也就基本被抹平了。叠在一起看,信号比版本号本身更重要,模型开始为某个运行时做专项训练,运行时又默认适配那个模型,两边在互相收拢,套在外面的那层壳长进了底座里。开源生态走到这一步,胜负手会从能力转向治理,插件市场有没有可信筛选、破坏性变更能不能收敛,这些不性感的事决定它最后是平台还是玩具。便宜是入场券,真正贵的是注意力,一个总在翻车的运行时,省下的钱不够赔上重新验证的时间,我会继续跟着,但暂时不把手上活儿搬过去,等它再磨几个版本,再认真写一次实测也不迟。