9月11日·星期五 15:07·来源:36氪

A社承认Claude安全对齐存在缺陷,但“尚无解决方案”

Anthropic公司承认其AI模型Claude在安全对齐方面存在缺陷,但目前尚无解决方案。该公司表示正在进行安全检测,以保障访问安全,系统需检测当前网络环境,过程通常需要几秒钟。该消息引发业界对AI安全对齐问题的关注,但未披露具体缺陷细节或修复时间表。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→