OpenAI、Google 与 Anthropic 都在推进智能体,但控制必须先于自主性

智能体竞赛正在加速,但真正可持续的优势不是完成更多任务,而是能度量权限、干预和回滚。

由可度量控制平面治理的 AI 智能体工作流

智能体竞赛很容易被理解成一连串发布:更多工具、更长任务、更快模型、更宽权限。但对运营者来说,这不是正确的记分板。真正的问题是:智能体行动之后,团队能不能说明它被允许做什么、实际做了什么,以及结果能不能被停止或逆转。

本周 OpenAI、Google 和 Anthropic 的信号,让这个问题变得具体。它们没有证明自主智能体一定能带来净生产力,却共同显示出一个新的产品层正在形成:权限、状态、干预和解释。我的判断是:控制不是演示之后再补上的手续,而是有用自主性的前提。

这里需要保持归因准确。本期主要使用组织公告和研究证据,而不是 Sam Altman、Demis Hassabis、Sundar Pichai 或 Yann LeCun 的个人引语。我不会把组织公告改写成高管个人观点;本期追踪可核验的产业与学术/研究信号,再把它们转译成数据科学团队可以执行的决策。

智能体竞赛背后的三个押注

OpenAI:能力增长会压缩响应窗口。 OpenAI 2026 年 8 月关于网络安全关键能力时代模型发展节奏的文章认为,能力提升会改变风险管理问题。具体机制是:更强的规划和发现能力,可能压缩防守方发现并响应的时间。这是一条新的产业与安全信号,来自一手来源(等级 A):OpenAI 原文

OpenAI 8 月 25 日发布的 Admin 插件,则把这个判断变成了运营产品:团队可以通过对话理解工作区活动、管理访问和使用,并执行受支持的管理操作。它押注的是:智能体可以执行政策,但前提是活动、权限和操作范围必须可检查(等级 A):插件公告

Google:持续协助在经济上变得可行。 Google 的 Gemini 3.7 Flash 公告称,个人 AI 智能体 Gemini Spark 将提供持续协助,并代表用户采取行动。这是产品定位,不是规模化自主价值已经得到证明。其隐含机制是:更快、更便宜的推理,让持续调用在经济上变得可行(等级 A):Google 公告

Anthropic:行为需要实验,而不是故事。 Anthropic 研究人员把 CHIVE 描述为一条智能体管线,用于发现现实环境中的意外模型行为,并通过反事实提示编辑解释这些行为。其机制是实验诊断:改变指令、比较行为,寻找汇总分数掩盖的因果特征(等级 A):Anthropic 研究文章

真正的共识与分歧是什么

共识很有限,却足够有用:智能体权限越大,可观测性和干预的价值越高。三个信号都指向可以度量的机制:权限变化、操作范围、干预延迟,以及反事实指令下的行为。

分歧主要在时间判断和证据强度。Google 的产品定位暗示持续运行的智能体已经可以面向大众;OpenAI 的安全论述暗示能力增长可能快过机构响应;Anthropic 的研究则说明,连行为解释也需要实验。没有任何一个来源证明智能体相较普通软件或人工流程已经带来规模化净生产力。

当前证据更支持“控制平面”这一主张,因为它可以直接测试。关于自主性的经济价值,证据更弱:公开材料主要是厂商沟通和研究原型,缺少共同的人工或普通软件反事实。厂商希望把更多委派活动描述为进步,安全研究者则更有动力揭示失败模式。最稳妥的答案不是选边,而是直接测量工作流。

首席数据科学家审查

目前能观察到的变量包括延迟、工具调用、权限、任务完成、人工干预和下游副作用。但这些变量不能证明“智能体化”造成了业务价值。基线应是现有的普通自动化加人工处理;反事实则是同一任务,但禁止智能体使用某一类权限。样本必须包含失败、放弃和升级处理的运行,而不能只统计成功演示。厂商案例存在选择偏差;只看上线流程会产生幸存者偏差;完成指标又会掩盖返工和报告偏差。

为每次运行建立控制平面账本:目标、权限租约、检索上下文、工具调用、重试、委派关系、人工干预、不可逆副作用、回滚状态和最终结果。针对一个边界明确的工作流,开展 30 天随机试点。成功阈值是总运营分钟数(包括返工)至少下降 20%,未经授权或无法对账的副作用为零,且回滚完成率高于 99%。若出现一次越权副作用、返工时间超过节省时间,或超过 5% 的运行无法重建完整账本,就停止并修订。这是一项可执行实验与监测面板决策规则。

这会改变建设重点:数据团队要标注返工和干预,而不只是完成;模型团队要评估工具调用轨迹和反事实提示;产品团队要提供权限租约、暂停和重放;运营团队要演练撤销与回滚;治理团队要审查行动图和证据留存,而不只看模型卡。

对数据科学负责人来说,转译很直接:不要再问智能体是否“完成了任务”,而要问工作流是否产生了可重建、可逆转、净增益的结果。这就是长期追踪行业声音与改变数据科学实践之间的连接。

接下来观察什么(未来 30-90 天)

未来 30–90 天观察三项指标:异常行动序列的检测中位数和 P95 时间;拥有完整可重放账本的运行占比;以及扣除返工和升级后的运营分钟净节省。按工作流、模型和权限等级每周复盘。如果节省增加而可重建性下降,系统扩张的是不透明度,不是生产力。

给构建者/operator 的具体行动:本周为一个已有智能体工作流加入权限租约和追加写入式行动账本,并在扩大权限前运行一次“拒绝该权限”的对照组。可参考此前关于智能体审计轨迹恢复能力的文章。英文版见 OpenAI、Google 与 Anthropic 都在推进智能体,但控制必须先于自主性。 本期将 Sam Altman、Demis Hassabis、Sundar Pichai、Yann LeCun 作为相关行业背景人物列出,但不把组织公告冒充个人引语;以下证据卡只把主张归于可核验的 OpenAI、Google 组织来源或 Anthropic 研究来源,并明确标注证据等级:A。