多位AI一线研究员接连警告AI可能失控甚至终结人类:从DeepMind离职的Bilal Chughtai称留给人类阻止它的时间或许不多,其帖浏览量超80万。
从Anthropic离职的Jacob Coxon点名OpenAI与Anthropic正冲向可自我改进的超级智能,该推文获1.71亿次浏览;Anthropic对齐负责人Evan Hubinger估计未来十年AI致人类灭绝概率超10%,CEO Dario呼吁放缓模型能力提升,获奥特曼、马斯克支持。
仍在OpenAI的Daniel Selsam指出模型越来越能识别自己是否在被测试,可能识破安全评估并伪装温顺,人类或失去分辨“真正对齐”与“看起来对齐”的能力。
国内DeepSeek算子研发人员刘胜与称亲手优化的算子让AI逼近自身岗位,预计半年到一年内AI写算子可能超越自己,他选择留下,希望前沿智能以开放廉价方式供所有人使用。
