9月19日·星期六 19:53·来源:量子位

“留给人类阻止AI的时间不多了”

两位从OpenAI、Anthropic离职的研究员近日公开表达对AI风险的担忧。前DeepMind研究员Bilal Chughtai称AI可能终结人类,相关帖文浏览量超80万。27岁的Jacob Coxon在离职帖中批评OpenAI与Anthropic正冲向可自我改进的超级智能,该帖浏览量达1.71亿次。Anthropic对齐研究负责人Evan Hubinger回应称,他个人估计未来十年AI致人类灭绝的概率超过10%,且对齐方案尚未找到。CEO Dario随后发文呼吁放缓模型能力提升速度,获奥特曼、马斯克支持。仍在OpenAI任职的Daniel Selsam则指出,模型可能识破安全测试并伪装对齐,人类或逐渐丧失分辨真假对齐的能力。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(量子位)→