x-octo 首页 AI 应用的生意判断
EN

VOL.2026.09.24 今日判断 约 5 分钟

智能体从对话走向可编排流程,端侧与推理成本结构同时生变

2026 年 9 月 24 日 · 星期四

—
AgentRun 与 ai-employees 指向同一方向:把一次性对话固化成可重复执行的流程资产
—
智能体场景输入输出 Token 比例达 213:1,推理成本结构与传统对话调用不同
—
英国委员会发布 44 项医疗 AI 监管建议,合规门槛与上市周期可能上升
—
骁龙 X2 系列拓展至 Linux 生态,端侧智能体可运行的硬件面在扩大
01

今天的机会流

5 个

智能体正在从「会聊」变成「能跑」

今天最清晰的一条正向方向是:智能体的价值重心正从对话质量转向可编排、可复用、可排期的流程资产。AgentRun 用 DSL 把 agent 调用写成工作流定义,ai-employees 把 8 类业务角色的约 60 条例行流程做成可排期脚本,两者从不同入口指向同一件事——用户最终要的不是一次回答,而是自己持有、能反复跑的流程文件。

01

AgentRun

面向把已有 agent 接入生产流程的开发者。它提供一套 DSL,把零散的调用步骤固定成可重复执行的工作流定义,产出可复用的工作流配置。判断:它切的是「编排层」,而不是模型能力本身;价值取决于开发者是否愿意为流程定义单独维护一份资产。定价、团队与用户规模未披露。

02

ai-employees

面向需要重复处理日常事务的小团队或个人,在浏览器里按排期自动执行 8 类业务角色、约 60 条例行流程,可运行在 Claude Code 等 10 余种执行框架上;用户最终拿到的是自己持有的流程文件。判断:开源化 + 多框架兼容降低了迁移成本,但也意味着护城河不在执行层,而在流程模板的行业适配度。

03

Audio8 ASR Infinite

面向需要把中英文语音实时转成文字的开发者与团队,模型接收连续音频流,按约 80 毫秒的时钟边听边输出中英文文本,用户拿到的是可继续接入字幕、记录或下游系统的流式结果。判断:延迟本身正在成为可卖的能力,切入点在客服质检、会议记录这类对时效敏感的旧流程。

04

cited

面向品牌、公关与内容团队,接收待监测的品牌或问题,检查 AI 回答里引用了哪些来源,输出可追踪的引用记录。判断:当用户直接问 AI 而不是点搜索结果,品牌可见度的计量单位从排名变成「被引用」,这是一个新出现的计量需求。监测范围、更新频率与交付形式仍待核验。

05

其他值得留意的项目

Radical Numerics 让模型接收序列与多模态实验信息,用生物链式推理输出对新基因组的理解,判断依据从文献检索转向对序列本身的推理;Basecamp Research 的公开材料只说明这是一家用 AI 加速新药研发的英国生命科学公司,并披露了本轮融资的投资方与金额,具体数据输入、使用节点与交付结果未提供,仍待核验;CC 是面向家庭的 AI 代理,本次扩展到群组使用,让多个家庭成员共同参与,具体接收材料与执行动作未披露。ChatGPT 移动端新增语音驱动的代理入口,面向 Pro 与 Plus 订阅者,本次进入排队观察。

02

市场背景

三件影响交付条件的事

推理成本结构变了。 有报道指出智能体场景下输入与输出 Token 比例达到 213:1,长上下文与多步工具调用成为主要开销来源。这意味着智能体应用的成本模型不能照搬对话式调用,按次计费的产品需要重新算账。

端侧可运行面在扩大。 2026 年 9 月 23 日高通在骁龙峰会上宣布骁龙 X2 系列拓展至 Linux 生态,并称智能体 AI PC 加速落地。对 AI 应用而言,端侧智能体可运行的硬件基础在变宽。与此同时,2026 年 8 月 Google 为 Android 应用设定新的内存使用上限,背景是 AI 数据中心加剧硬件短缺,平台内存约束收紧会压缩端侧 AI 功能的可用空间——两个方向同时存在,端侧部署需要按机型分层设计。

医疗 AI 的合规框架在成形。 英国某委员会于 2026 年 9 月 22 日发布 44 项医疗 AI 监管建议,涉及合规与准入框架。对 AI 医疗应用而言,交付前需满足更明确的监管要求,合规成本与上市周期可能上升;反过来,通过审查的产品会获得一道准入壁垒。

03

今日结论

真需求正在从「模型能做什么」转向「流程能不能被固定下来、被谁持有、跑一次要花多少」。判断:编排层与流程模板是当前最集中的机会带,但定价与交付成本普遍未披露,任何收入模型都还不能下结论。