据Anthropic披露数据,Claude已经主导26%的内部AI研发工作,协作超过90%的相关任务;主导是指人类提供高层级指令,AI完成大部分工作,人类则负责监督。同时Claude尚未在任何被测AI研发工作中达到完全自主运行的水平。 AI正在越来越多地参与开发下一代AI。 当地时间周四,Anthropic公布了一组用于追踪前沿AI实验室研发进展的新指标。数据显示,截至今年8月,Claude已经“主导”Anthropic约26%的AI研发工作;与此同时,约3万个AI Agent在该公司同时开展研究和工程工作。 不过,Anthropic的数据也显示,AI距离完全自主开展AI研发仍有明显距离。截至8月,Claude尚未在任何被测AI研发工作中达到完全自主运行的水平。 Anthropic表示,希望通过持续披露这些指标,缩小前沿AI实验室内部实际进展与公众所能了解的信息之间的差距。 Claude已主导26%的AI研发工作 根据Anthropic披露的数据,截至8月,Claude参与的AI研发工作中,约26%已经达到“AI主导”(AI leads)的自动化水平。 这一指标参考了Epoch AI的AI研发自动化分级体系。其中,“AI主导”意味着,人类可以提供较高层级的指令,而AI完成大部分具体工作,人类则负责监督。按此标准,Claude主导的研发占比在今年2月尚不足1%。 目前超过90%的相关任务已经达到“AI协作”(AI collaborates)或更高的自动化水平。 不过,Anthropic同时强调,Claude目前尚未在任何被测的AI研发工作中达到完全自主的水平。这意味着,尽管AI已经深入参与模型研发和工程流程,但人类仍然处于研发流程的重要环节。 3万个Agent同时开展研究和工程工作 Anthropic披露的另一项指标显示,今年8月约有3万个AI Agent同时在公司内部执行研究和工程工作。 这一规模反映出,AI Agent正在从单纯的辅助工具逐渐成为企业研发流程中的实际生产力。 Anthropic还对8月超过10亿次AI Agent决策进行了分析。数据显示,在线监控系统拦截了约0.002%的Agent决策,即大约每4.7万次决策中有1次被拦截。 这一数据衡量的是被监控系统阻止的决策比例,并不等同于AI的错误率或危险行为发生率。 |
| |||||||||||||||||||||
点击朱笔,直抒胸臆