鼓狮财经9月17日报道,继Anthropic首席执行官阿莫德伊上周呼吁业界放缓AI发展步伐引发震动后,该公司周四公布了三项新指标,旨在帮助人工智能公司监测自身发展进度。其中一项披露显示,Anthropic旗下大模型Claude目前已在公司内部主导了26%的AI研发工作。
该公司在周四的博客文章中介绍了这三个维度的进展,并分享了相关方法论,鼓励其他组织效仿。文章强调:“当全球都在探讨如何把控前沿技术的演进步调时,我们必须竭尽所能,消除顶尖实验室与公众之间的信息鸿沟。”这意味着需要更精准地量化AI发展进程,向社会公开透明披露,并让公众共同参与决策。
阿莫德伊上周末提出的放缓AI研发呼吁,获得了包括OpenAI首席执行官奥尔特曼、SpaceX首席执行官马斯克以及谷歌DeepMind联合创始人哈萨比斯在内的行业领袖的支持。此前,研究人员已就人工智能日益增长的潜在危害发出严厉警告。阿莫德伊表示,其计划旨在控制模型能力提升的速度,同时“不牺牲商业优势或美国在人工智能领域的领先地位”。
关于第一项指标“AI参与AI研发”,Anthropic构建了“Anthropic研发自动化指数”,用于衡量Claude在多大程度上完成了公司的AI研发工作。评估方法是对内部各类AI研发任务进行编目,评估每项任务的自动化程度并汇总。为了量化AI的参与程度,Anthropic采用了Epoch AI开发的自动化评级量表,该量表衡量“自动化等级”(AL),从AL0(无AI参与)到AL5(AI完全自主运行,无需人类介入)。在AL3(AI协作)级别,AI可在人类密切指导下完成工作;在AL4(AI主导)级别,AI可依据高阶提示词端到端完成大部分任务,人类仅负责监督。截至2026年8月,Claude尚未在任何被测量的AI研发工作中实现“完全自主运行”(AL5),但已“主导”(AL4)约26%的AI研发工作。值得注意的是,AL4级别的比例在2026年2月还不到1%。Anthropic认为,此类指标有助于观察AI研发自动化程度是否持续提高,以及距离“递归自我改进”——即AI能够完全自主开发下一代AI还有多远。
第二项指标聚焦于“对AI智能体的监管与干预”。Anthropic构建了监督系统来约束智能体的行为。监测数据显示,在Anthropic最核心的内部平台上,随时约有30000个智能体在协同执行研究与工程任务。这些智能体的行为受到在线和离线两类监测系统的双重约束。Anthropic补充称,智能体的每一步操作在执行前都会经过前置审查;在当月产生的逾10亿次决策指令中,平均每47000次操作就有一例被在线监测系统拦截。
第三项指标是“公司内部的计算资源分配情况”。Anthropic公布了7月份某抽样周的算力分配细节:在Anthropic用于AI研发的总算力中,约有6%投向了安全领域;而在由AI独立推进的研究中,安全算力占比则提升至12%。Anthropic表示,该统计口径偏向保守,例如,如果某个Token所消耗的算力既推进了模型能力又增进了安全性,则不会计入这些安全指标中。
Anthropic指出,传统评测侧重于考察“模型能做什么”(能力评估),而上述新指标的价值在于揭示“模型是如何构建的”,二者能互为补充。结合这套体系,外部第三方机构将拥有一个切实的评估支点,以研判AI发展的真实速率。Anthropic表示,希望通过公布这些量化数据树立行业透明度的标杆,并持续推进这一举措。
