x-octo 首页 AI 应用的生意判断
EN

AI 应用的生意判断

deepseek-harness

重点研究

DeepSeek 把助手的工具、记忆、界面拆成可替换插件,在自己电脑上跑

还不是生意 早期 基础层开源关注 600
团队 / 作者
deepseek-ai
本站首次收录
2026-08-13
本站最近更新
2026-09-04
产品官网
查看官网 ↗

01

它为什么会被需要

从用户的一天开始 · 公开事实 + 可观察行为 · 2026-09-01

使用场景

DeepSeek 把助手的工具、记忆、界面拆成可替换插件,在自己电脑上跑

公开材料尚未说明用户目前如何完成这项工作、它实际替代了什么。

它试图减少完成这项任务时的摩擦;公开用户材料尚未说明不解决的具体代价、发生频率或后果。

xOcto 的判断

这是模型公司打「harness 层战争」的标准动作,但比同类激进:连 agent loop、调度、UI 都做成插件。 激进换来的东西很明确——生态进入门槛低到一个人也能写插件,而它眼下最需要的恰恰是插件生态(这也是本期同批 DSH 插件值得一起看的原因)。

趋势是模型公司送壳、靠调用赚钱,换大脑变成改一行配置。切入做企业要留在内网的助手运行时:插件可审计、可替换;壳免费,钱在模型调用。

使用理由

为什么用户会选择它

公开代码仓库有 202,230 个收藏,说明开发者正在关注或试用;持续使用与付费仍未核验。

还不能轻易下结论的地方

真正值得继续追问的矛盾

① 三个月后 star 能否从 7 万级继续向上——发布冲量 vs 持续吸纳; ② dsh-plugin 主题与 dsh-external 目录里「被企业实际使用」的插件数量(插件数量 ≠ 插件质量); ③ 破坏性变更的节奏——RC 阶段每两周断一次接口是早期常态,三个月还这样说明还没到稳定期

如果你正在做这项工作

值得拆解。公开代码仓库有 202,230 个收藏,说明开发者正在关注或试用;持续使用与付费仍未核验。

怎样切入 / 可以借走什么

如果你正站在「平台 vs 工具」的岔路口,可以照这个分层法——把核心循环做成可替换层,模型、工具、UI 全部插件化,先亏着把壳送出去,再在另一层(模型调用)的用量上收钱。前提是另一层边际成本够低,且你承受得了生态初期的质量参差。 峰谷定价值得抄——高峰两倍、空闲半价,不动总价就把需求引导到空闲时段,等于免费扩容了高峰之外的收入。对推理成本本身有峰谷的 AI 产品尤其适用。

证据与风险

Harness 开源免费,钱在模型调用上。2026-08-13 宣布 API 峰谷定价:高峰时段(北京时间 9:00–12:00、14:00–18:00)价格为空闲时段的两倍,新价格 2026-08-17 生效。 ① 三个月后 star 能否从 7 万级继续向上——发布冲量 vs 持续吸纳; ② dsh-plugin 主题与 dsh-external 目录里「被企业实际使用」的插件数量(插件数量 ≠ 插件质量); ③ 破坏性变更的节奏——RC 阶段每两周断一次接口是早期常态,三个月还这样说明还没到稳定期

我们凭什么这样判断
公开事实

DeepSeek 把助手的工具、记忆、界面拆成可替换插件,在自己电脑上跑

工作流推理

公开代码仓库有 202,230 个收藏,说明开发者正在关注或试用;持续使用与付费仍未核验。

会改变判断的未知

公开补证:追踪项目文档、issue 和 discussion,确认谁在何种强场景部署、替代了什么旧流程。

01 · 价值 证据不足

产品主张帮助用户完成:“DeepSeek 把助手的工具、记忆、界面拆成可替换插件,在自己电脑上跑”。具体痛点强度与不采用代价尚未由用户证据核验。

02 · 共识 证据不足

价值闸门未通过,共识闸门未进入。

03 · 模式 证据不足

价值闸门未通过,模式闸门未进入。

04 · 求真 证据不足

价值闸门未通过,求真闸门未进入。

02

中英文生态与跨国机会

市场对照

英文生态 · English-language market

本地供给:早期出现
需求证据:尚未核验

已覆盖的英文生态公开项目发布与开发者讨论。 · 2026-09-04

03

60 秒生意判断

先给出判断与下一步,再保留完整证据和反例。

一句话定位

官方公式是「模型 + Harness = Agent」:它不产模型,也不只是一个聊天界面,而是把工具、技能、会话、沙箱、存储、循环、调度、UI 全部拆成可替换插件的一套本地 agent 运行时。

做这个东西的人

DeepSeek 官方仓库(deepseek-ai/deepseek-harness)。2026-08-13 晚发布开发者预览版 v0.1,MIT 协议全量开源。底层插件系统 Cordis 的理念来自北京大学与 DeepSeek 联合署名的论文《A Programming Paradigm for Spatiotemporal Composability》。据智东西报道,团队负责人崔添翼公开表示这是预览版、可能很粗糙。

判断:一家模型公司把「模型之外的那一层」开源,等于明牌——竞争已经转移到 harness 层,而它想成为那层的默认底座。同一天它先宣布 V4-Pro 上线和 API 涨价,两小时后放 Harness,这个节奏是算过的。

它到底能做哪几件事

  • 四种运行时模式 → Standard(完整工具集)、Code 模式(模型写 TypeScript 程序编排多轮工具调用)、Minimal(只留 shell 和文件编辑器,用于公平评测模型)、Creator(检查当前运行时、在内存中试验插件、组合新模式)
  • 每次运行可追溯 → 模型看到的一切(系统提示、推理、工具调用与结果、子 agent 调度、每次上下文注入)写入 append-only 会话日志,Trajectory 视图按来源检查,resume / fork / search / replay 都跑在同一个事件流上
  • 一切皆插件 → 模型、工具、技能、会话、沙箱、存储、循环、调度、UI 都是 Cordis 插件,配置层组合,不改源码
  • 本机沙箱 → 仓库带 Landlock 沙箱运行时(native/),不是只有提示词约束
  • 一条命令启动 → npx @deepseek-ai/dsh web 起本地 Web UI

它在替代什么旧行为

以前做一个 coding agent,流程是选一个封闭 harness(Claude Code、Codex、Cursor),然后在里面做有限的工具和技能扩展——可替换范围基本停在「工具与技能层」,循环、调度、会话、UI 是黑盒,模型是被绑死在 harness 里的 API。

DSH 把替换边界下探到整个运行时,模型本身也只是一个可替换插件。旧工作流的画面:团队先选 harness,再往里塞工具,模型厂商只是接口。新画面:模型和 harness 解耦成两层,各自可换。DeepSeek 赌的组合是「最便宜的 token + 开源的 harness」,这是其它闭源 harness 厂商给不了的。

商业模式

Harness 开源免费,钱在模型调用上。2026-08-13 宣布 API 峰谷定价:高峰时段(北京时间 9:00–12:00、14:00–18:00)价格为空闲时段的两倍,新价格 2026-08-17 生效。

判断:把壳送出去,让换大脑变成一行配置——这正是拥有最便宜 token 的模型公司想要的世界。免费不是慈善,是获客。

硬数字

  • 73360 star / 6265 fork(2026-08-14 抓取),发布半小时 star 破万,媒体报道时已超三万
  • 仓库 12000+ 次提交,版本 v0.1.0-rc.5,2026-08-13 起 221 个 packages/apps 以 public 身份发布到 npm
  • 同日 DeepSeek-V4-Pro 正式版上线
  • 团队规模、企业用户数:未披露

四维评估

维度 结论
创始人-产品匹配度 模型公司做模型上方的运行时,匹配度极高;风险在于「开发者工具」是它以前没有的组织能力
产品洞察力 「一切皆插件」把替换边界从工具层下探到运行时,判断准确;append-only 会话日志作调试地基,是多数 harness 没做好的
技术实现质量 12000+ 提交、RC 版本、221 个公开 npm 包、Landlock 沙箱,工程规格不是 demo
市场时机 在 Claude Code/Codex 验证市场之后入场,用开源 + 低价 token 打组合拳,时机和价格都踩在点上

判断

这是模型公司打「harness 层战争」的标准动作,但比同类激进:连 agent loop、调度、UI 都做成插件。 激进换来的东西很明确——生态进入门槛低到一个人也能写插件,而它眼下最需要的恰恰是插件生态(这也是本期同批 DSH 插件值得一起看的原因)。

对从业者:DSH 把「换模型」变成一行配置,模型选型成本趋近于零。如果你在卖模型,这是最坏的剧本;如果你在模型之上做产品,这是目前最好的地基。

代价:v0.1 预览版官方明说会快速迭代、有破坏性变更;早期插件生态的质量几乎必然参差。它现在的价值在「架构示范」,不在「开箱即用的产品」。

下一步看什么

① 三个月后 star 能否从 7 万级继续向上——发布冲量 vs 持续吸纳 ② dsh-plugin 主题与 dsh-external 目录里「被企业实际使用」的插件数量(插件数量 ≠ 插件质量) ③ 破坏性变更的节奏——RC 阶段每两周断一次接口是早期常态,三个月还这样说明还没到稳定期

可借鉴的做法

产品逻辑:如果你正站在「平台 vs 工具」的岔路口,可以照这个分层法——把核心循环做成可替换层,模型、工具、UI 全部插件化,先亏着把壳送出去,再在另一层(模型调用)的用量上收钱。前提是另一层边际成本够低,且你承受得了生态初期的质量参差。

定价结构:峰谷定价值得抄——高峰两倍、空闲半价,不动总价就把需求引导到空闲时段,等于免费扩容了高峰之外的收入。对推理成本本身有峰谷的 AI 产品尤其适用。

结论

强烈推荐。 这是 2026 年 agent 基础设施领域最重要的事件之一,做 AI 产品的人都值得花一小时读完它的架构文档。三个月后拿上面三条验证生态是否真的起来。

04

可核验公开证据

证据链

05

从产品名直接追到一手材料

产品官网缺失或当前链接只是线索时,从这些检索入口继续核验。