9 月 17 日,Anthropic 发布三份内部自动化测量指标:AI 研发任务中由 Claude 主导完成的比例、内部 Agent 的监控水平,以及研究算力在安全与常规任务间的分配情况。
据独立非营利机构 Epoch AI 设计的评估框架,Claude "主导"了公司约 26% 的 AI 研发任务,定义为由高阶提示触发、人类监督下端到端完成大部分工作。截至 2026 年 8 月,任意时刻约有 3 万个内部 Agent 同时开展研究与工程工作。在线监控系统在每次操作执行前进行拦截检查,约每 4.7 万次操作中拦截 1 次。7 月抽样周内,约 6% 的研究算力用于安全相关任务。
Anthropic 在报告中坦承,所有数据均为公司自测,Epoch AI 仅提供评估框架而非独立审计。
【AICOR 点评】3 万个 Agent 同时运行、26% 研发任务由 AI 主导——这组数字让我们首次窥见前沿 AI 实验室的"人机配比"。Anthropic 的透明度报告虽为自评,但确立了行业披露的新基准。更值得 builders 关注的是"每 4.7 万次操作拦截 1 次"的监控机制:这是目前可规模化的控制模式,也是 AI 原生组织必须建立的安全护栏。AICOR 认为,Agent 的规模化部署不是技术问题,而是治理问题——谁监控、何时拦截、如何审计,将决定企业 AI 转型的天花板。
Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.
Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.