关于ZAKER Skills GEO服务 合作
全天候科技 4小时前

Claude 已“主导” Anthropic 26% AI 研发工作,3 万 Agent 同时上岗,RSI 仍未实现

AI 正在越来越多地参与开发下一代 AI。

当地时间周四,Anthropic 公布了一组用于追踪前沿 AI 实验室研发进展的新指标。数据显示,截至今年 8 月,Claude 已经 " 主导 "Anthropic 约 26% 的 AI 研发工作;与此同时,约 3 万个 AI Agent 在该公司同时开展研究和工程工作。

不过,Anthropic 的数据也显示,AI 距离完全自主开展 AI 研发仍有明显距离。截至 8 月,Claude 尚未在任何被测 AI 研发工作中达到完全自主运行的水平。

Anthropic 表示,希望通过持续披露这些指标,缩小前沿 AI 实验室内部实际进展与公众所能了解的信息之间的差距。

Claude 已主导 26% 的 AI 研发工作

根据 Anthropic 披露的数据,截至 8 月,Claude 参与的 AI 研发工作中,约 26% 已经达到 "AI 主导 "(AI leads)的自动化水平。

这一指标参考了 Epoch AI 的 AI 研发自动化分级体系。其中,"AI 主导 " 意味着,人类可以提供较高层级的指令,而 AI 完成大部分具体工作,人类则负责监督。按此标准,Claude 主导的研发占比在今年 2 月尚不足 1%。

目前超过 90% 的相关任务已经达到 "AI 协作 "(AI collaborates)或更高的自动化水平。

不过,Anthropic 同时强调,Claude 目前尚未在任何被测的 AI 研发工作中达到完全自主的水平。这意味着,尽管 AI 已经深入参与模型研发和工程流程,但人类仍然处于研发流程的重要环节。

3 万个 Agent 同时开展研究和工程工作

Anthropic 披露的另一项指标显示,今年 8 月约有 3 万个 AI Agent 同时在公司内部执行研究和工程工作。

这一规模反映出,AI Agent 正在从单纯的辅助工具逐渐成为企业研发流程中的实际生产力。

Anthropic 还对 8 月超过 10 亿次 AI Agent 决策进行了分析。数据显示,在线监控系统拦截了约 0.002% 的 Agent 决策,即大约每 4.7 万次决策中有 1 次被拦截。

这一数据衡量的是被监控系统阻止的决策比例,并不等同于 AI 的错误率或危险行为发生率。

AI 研发越自动化,安全问题越受关注

Anthropic 同时公布了 AI 研发计算资源的分配情况。

在 7 月 13 日至 7 月 20 日的一周内,公司约 6% 的 AI 研发计算资源用于安全工作;如果只计算由 AI 驱动的 AI 研发工作,约 12% 的计算资源被用于安全相关工作。

随着 AI 越来越多地参与 AI 模型本身的研发,AI 安全也成为一个越来越重要的问题。

Anthropic 表示,公司计划让独立第三方评估机构获得对内部流程和数据的访问权限,以便对安全实践进行验证,并帮助外部人士了解前沿 AI 实验室内部 AI 研发的实际进展。

这一安排意味着,AI 实验室正在尝试通过第三方评估,减少企业内部信息与外部公众认知之间的差距。

从 "AI 辅助研发 " 走向 "AI 驱动研发 "

Anthropic 此次披露的数据提供了一个观察 AI 产业发展的新角度:市场过去主要通过模型参数、基准测试成绩和用户数量衡量 AI 进步,而 Anthropic 开始尝试衡量 AI 究竟在多大程度上参与了开发下一代 AI。

从目前的数据来看,AI 已经深度进入前沿 AI 实验室的研发流程,大量 Agent 正在承担研究和工程任务,但完全由 AI 独立完成整个研发过程仍未实现。

这也意味着,当前 AI 产业正在经历的变化,与其说是 "AI 已经能够自主研发 AI",不如说是 AI 正在快速提高自身参与 AI 研发的程度。

随着这一比例继续提升,如何衡量研发自动化程度、如何监督 AI Agent 行为,以及如何确保安全投入跟上研发自动化速度,可能成为前沿 AI 实验室未来需要持续回答的问题。

全天候科技

全天候科技

提供专业快速完整的科技商业资讯

订阅

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容