使用场景
个人用户(尤其不会写脚本的人)在浏览器里处理需要多步点击、填表、翻页的网页任务时,让 DeepSeek Harness 桌面端模型把当前页面读成带编号控件的文本并代为点击、输入、滚动、跳转、管理标签页,自己只做执行前确认。
人工逐页点击填表;或使用脚本、RPA 录制固定流程;以及把页面内容复制给通用聊天模型再手动执行其建议。
公开材料显示这类操作步骤碎、重复度高,用户要在页面间反复切换并重复输入相同信息;旧做法是手工逐页点击或写脚本、RPA 录制固定流程,页面一改版脚本即失效,普通用户又写不出脚本,出错后常需重来。
xOcto 的判断
需求有依据
趋势是浏览器操作正在从“人点”变成“模型读页面再点”,而入口之争落在谁能拿到用户已登录的真实页面上下文。切入可考虑电商后台改价、政务与保险表单填报、跨境卖家多平台刊登这类高频重复点击场景,按完成的任务量或成功提交次数收费;但需先解决登录态、验证码与误操作回滚,否则只能停在演示。
使用理由
为什么用户会选择它
推断:相较手工点击或写脚本,它把页面读成带编号控件的文本后直接执行动作,用户不必自己找按钮、填字段,页面改版也无需重写脚本;执行前询问、密码留在页面内、只与用户自己的桌面端通信,减少了把账号交给第三方的顾虑。因此常做重复网页操作又不会写脚本的个人用户会在遇到多步表单或翻页任务时选择它。
还不能轻易下结论的地方
真正值得继续追问的矛盾
追踪该 公开代码仓库 仓库的 README、issue 与 discussion,确认实际支持的网站范围、失败与回滚机制,以及是否有用户报告在真实工作流中重复使用。