9月17日消息,Anthropic表示,其大模型助手Claude已经主导了公司内部26%的AI研发工作。为了让外界直观看到AI推动下一代技术演进的速度,公司未来将把这类数据作为常规指标定期发布。
这家总部位于旧金山的AI公司称,截至今年8月,超过90%的内部研究工作都已经有人类与AI协作参与。
需要注意的是,Claude目前还没有在这些研发工作中实现完全自主运行。但按照独立非营利研究机构Epoch AI制定的衡量标准,Claude对技术研发的贡献比例已经从今年3月的1%迅速升至26%。
这组数据提供了一个少见的观察窗口,让外界能够了解头部AI公司究竟在多大程度上使用AI来研发AI。这一点尤其受到关注,因为业内越来越担心,AI可能逐渐进入一种能够帮助提升自身能力、对人类参与依赖越来越低的阶段。
研究人员此前警告,随着AI智能体自主程度提升,其行为可能逐渐偏离开发者最初设定的目标,并变得越来越难监控和控制。
就在Anthropic公布这些数据的前一天,竞争对手OpenAI也宣布,将开始定期公开AI出现意外行为或未经授权行为的报告,同时披露了6起令人意外或担忧的模型行为案例。
Anthropic透露,今年8月,在其主要内部平台上,任何一个时间点大约都有3万个AI智能体同时从事研究与工程工作。不过,这些智能体执行的每一个操作都会在真正实施之前接受检查。
数据显示,仅8月份,这些AI智能体就产生了超过10亿次操作决策,其中大约每4.7万次会有一次被系统拦截。
Anthropic还首次披露了AI安全研究的算力投入。今年7月抽取的一周数据显示,公司用于AI研究的总算力中,大约6%投入到了安全相关工作;如果只计算由AI自身完成的研究任务,安全研究占用的算力比例达到12%。
Anthropic表示,这还是相对保守的计算方式。因为一些既能提升安全性、又能增强模型能力的研究,在统计时被归入了能力研发,而不是安全研究。
扫码下载app 最新资讯实时掌握
