Fathom研究所报告:递归自我改进已在行业出现,Claude据报道承担Anthropic约26%研发工作

作者:Fathom Institute / AGI Hunt 发布时间:2026-10-09 18:43:40 浏览:2
关键字:
Fathom研究所发布预印本报告,援引Dario Amodei的说法称递归自我改进已开始在全行业出现:Claude据报道主导Anthropic约26%的研发工作,并在90%以上的研发任务中参与协作。报告同时提出「理解审计」机制以应对失控风险。

AI开始参与训练下一代AI

Fathom研究所发布的一份预印本报告引用Anthropic CEO Dario Amodei的观点称,递归自我改进——AI参与改进AI自身——已开始在全行业出现。报告给出的量化估算显示:Claude据报道主导了Anthropic约26%的研发工作,并在超过90%的研发任务中承担协作角色。

从效率工具到研发主体

这一数字的意义在于:前沿实验室的研发管线正逐步向模型本身让渡。当模型产出占比达到四分之一量级,模型能力改进与研发流程改进之间将形成正反馈回路,这正是递归自我改进的核心特征。

理解审计:给失控装上仪表盘

报告作者提出「理解审计」(comprehension audits)机制,主张在模型参与关键研发决策前,评估人类对模型推理过程的理解程度,防止理解缺口随迭代不断扩大。该提案与当前业界对可监控性的讨论形成呼应。

警示与争议并存

同期,图灵奖得主Yoshua Bengio在前沿实验室员工公开信运动后撰文,呼吁真正把安全放在第一位的员工离开前沿实验室;一个追踪数据库显示,已有45名研究人员与高管以安全或伦理理由离开OpenAI、谷歌DeepMind与Anthropic。人才流向与内部治理,正成为衡量AI安全承诺的新标尺。

阅读原文

本文由AI融业云采集并编辑,仅供学习使用!

本文来自agihunt.info,作者Fathom Institute / AGI Hunt

关于AI融业云:一站式AI应用服务平台,了解创始人 | 联系我们

有问题,请联系客服!http://www.rongyeyun.com/kefu/