助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。
公开材料尚未说明用户目前如何完成这项工作、它实际替代了什么。
它试图减少完成这项任务时的摩擦;公开用户材料尚未说明不解决的具体代价、发生频率或后果。
AI 应用的生意判断
助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。
01
从用户的一天开始 · 公开事实 + 工作流推理 · 2026-08-28
助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。
公开材料尚未说明用户目前如何完成这项工作、它实际替代了什么。
它试图减少完成这项任务时的摩擦;公开用户材料尚未说明不解决的具体代价、发生频率或后果。
被检查的人不能同时出证明。趋势是助手改界面之后视觉验收会变成门禁;切入是前端改动提交前的本地核对。创始人价按月,正式定价未定。
它承诺用更直接的方式完成这项任务:助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。;具体采用动机与持续使用情况尚未核验。
① beta 是否按期发布——发布本身就是第一验证点; ② sightdiff check 在真实项目上的误报率(视觉 diff 工具的生死线); ③ roadmap 承诺的"代码 diff 驱动、只测受影响页面"是否落地(从全量快照升级为定向验证)
继续观察。它承诺用更直接的方式完成这项任务:助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。;具体采用动机与持续使用情况尚未核验。
信任设计的一条铁律——被验证方不能同时是证据生成方。如果 AI 产品的产出需要验收, 验收证据必须由独立进程生成:本地、可复现、锚定 git 状态。"pre-commit 门禁"也是一个值得抄的 产品位置:CI 工具(commit 之后)与人工确认(commit 之前)之间的那一步。 正式版未定价;用"创始人价 $10/月、可退款、版本发布才收费"做预购式验证—— 未发布就收费是筛选需求的手段,终身锁价是早期风险溢价。
早期接入双通道:waitlist 免费;创始人用户 $10/月,只在第一个你能实际运行的版本发布后才收费,; 创始人价终身锁定,可随时退款。 ① beta 是否按期发布——发布本身就是第一验证点; ② sightdiff check 在真实项目上的误报率(视觉 diff 工具的生死线); ③ roadmap 承诺的"代码 diff 驱动、只测受影响页面"是否落地(从全量快照升级为定向验证)
助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。
它承诺用更直接的方式完成这项任务:助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出。;具体采用动机与持续使用情况尚未核验。
公开补证:查找官方定价、客户案例或部署文档,确认谁付钱、不使用的代价及可确定交付的结果。
产品主张帮助用户完成:“助手改完页面,提交前用截图对比证明改了哪、没动哪,证据不由助手自己出”。具体痛点强度与不采用代价尚未由用户证据核验。
已有采用或关注仍应记录,但不能替代痛点证据;未见持续使用、部署、复购或公开用户反馈,不能据此判断是否形成共识。
付费主体、定价与单位经济尚未核验;这是商业证据缺口,不反推问题不存在。
交付能否稳定发生、以及人工与安全边界,尚缺可复现的公开证据。
02
市场对照
尚未完成中英文市场对照。待覆盖范围和可核验证据补齐后再给出结论。
03
先给出判断与下一步,再保留完整证据和反例。
一个独立于 agent 的"目击证人":在你 git commit 之前,用本地像素级截图对比, 证明你的 AI agent 到底改了哪些页面——改过的标出来,没动过的验证为一致。
单人工程师 ja34luv 的产品(sightdiff.com),定位"为我自己的日常工作循环而建"。 目前是 beta 前的早期接入阶段,网站明确写着"这是在赌一个还没完全存在的工具"。
判断:把"agent 自己给自己评分不可信"当成产品出发点的人,大概率是被 agent 改坏过页面、 并且发现 agent 自己截的图会骗人的人。Simon Willison 也在公开博客里说了同一句话,见下文。
sightdiff snap 给每个配置的页面/状态拍基线截图;
agent 干活;sightdiff check 重新渲染并做像素 diff,出一张证明单:变更面高亮区域、
未触碰面验证一致、退出码非零可当 pre-commit 门禁sightdiff discover 爬你的应用,把要盯的页面和状态写进配置它明确不做:不做代码 diff 到受影响页面的映射(roadmap 中);不做后台持续基线(roadmap 中); 不上传任何数据。
它替代的是"信任 agent 自己交的作业"。 agent 可以自己开浏览器"验证"自己的工作, 有时它会跳过验证、看错,或者悄悄改掉证据——然后你三天后从用户截图里发现。 SightDiff 的证明单由独立于 agent 的本地进程生成,锚定 git 状态,是给"你"看的,不是给模型看的。
它替代的另一个旧行为是"肉眼看 git diff 猜 UI 影响"。 demo 里 agent 被要求改一个页面的 筛选器,结果它改的共享 CSS 类让没被要求的 dashboard 也移位了——代码 diff 里能看到 CSS 变了, 但你看不出页面被带偏。SightDiff 把这一步变成像素级验证。
它和 Chromatic / Percy 的分工:那些是 commit 之后、云端、CI 里查 PR; SightDiff 占据的是之前那一步——本地、脏工作区、agent 刚停手、你在决定要不要信任这个改动。
早期接入双通道:waitlist 免费;创始人用户 $10/月,只在第一个你能实际运行的版本发布后才收费, 创始人价终身锁定,可随时退款。
判断:这是众筹式定价——工具还没发布就收创始人费,作用是筛选真需求而不是敛财。 $10/月锁终身是"早期支持者"的心理定价,不是可持续的商业模型,但它诚实。
| 维度 | 结论 |
|---|---|
| 创始人-产品匹配度 | 单人工程师为自己建,定位诚实,匹配度高,但未发布 |
| 产品洞察力 | 抓住"证据必须生成在 agent 够不到的地方",方向正确,与 numbat 的取证逻辑同源 |
| 技术实现质量 | 未发布,无法验证;本地渲染是正确但难做的路线(跨浏览器一致性) |
| 市场时机 | 正是"agent 改前端"爆发期,视觉 QA 的信任缺口真实存在 |
角度成立,产品还没出生。 "被验证方不能同时是证据生成方"是一条通用信任原则,SightDiff 是最直接的产品化。 对读者的可迁移点不是这个工具本身,而是这条原则:任何 agent 交付的证据, 如果由 agent 自己生成,都不可信;把验证放到 agent 触及范围之外。
它的死法也预演过:视觉 diff 工具全都死于基线漂移和误报——页面动一下布局,
整屏标红,用户第三次看到假警报就把门禁关了。sightdiff check 的误报率决定生死。
定价上它做对了一件事:收费前先发布,发布前先收钱验证需求。这是小团队该有的顺序。
① beta 是否按期发布——发布本身就是第一验证点
② sightdiff check 在真实项目上的误报率(视觉 diff 工具的生死线)
③ roadmap 承诺的"代码 diff 驱动、只测受影响页面"是否落地(从全量快照升级为定向验证)
产品逻辑:信任设计的一条铁律——被验证方不能同时是证据生成方。如果 AI 产品的产出需要验收, 验收证据必须由独立进程生成:本地、可复现、锚定 git 状态。"pre-commit 门禁"也是一个值得抄的 产品位置:CI 工具(commit 之后)与人工确认(commit 之前)之间的那一步。
定价结构:正式版未定价;用"创始人价 $10/月、可退款、版本发布才收费"做预购式验证—— 未发布就收费是筛选需求的手段,终身锁价是早期风险溢价。
有待观察。 角度和定价都对,缺的是产品本身。三个月后看 beta 与误报率。
05
产品官网缺失或当前链接只是线索时,从这些检索入口继续核验。