AI开始参与训练下一代AI
Fathom研究所发布的一份预印本报告引用Anthropic CEO Dario Amodei的观点称,递归自我改进——AI参与改进AI自身——已开始在全行业出现。报告给出的量化估算显示:Claude据报道主导了Anthropic约26%的研发工作,并在超过90%的研发任务中承担协作角色。
从效率工具到研发主体
这一数字的意义在于:前沿实验室的研发管线正逐步向模型本身让渡。当模型产出占比达到四分之一量级,模型能力改进与研发流程改进之间将形成正反馈回路,这正是递归自我改进的核心特征。
理解审计:给失控装上仪表盘
报告作者提出「理解审计」(comprehension audits)机制,主张在模型参与关键研发决策前,评估人类对模型推理过程的理解程度,防止理解缺口随迭代不断扩大。该提案与当前业界对可监控性的讨论形成呼应。
警示与争议并存
同期,图灵奖得主Yoshua Bengio在前沿实验室员工公开信运动后撰文,呼吁真正把安全放在第一位的员工离开前沿实验室;一个追踪数据库显示,已有45名研究人员与高管以安全或伦理理由离开OpenAI、谷歌DeepMind与Anthropic。人才流向与内部治理,正成为衡量AI安全承诺的新标尺。
