8月31日·星期一 16:07·来源:36氪

一块GPU,Claude爆肝48小时自我对齐,效率狂飙15000倍

Anthropic近期公布了一项AI自我对齐技术实验成果:利用单一GPU,让Claude模型在48小时内完成自我对齐训练,效率较传统方法提升约15000倍。该实验通过模型自主生成训练数据并迭代优化,大幅降低了对人工标注和算力资源的依赖。技术细节显示,Claude在无外部干预条件下,成功实现了安全性与性能的同步提升。业内认为,此举可能显著降低大模型对齐成本,加速AI安全领域研究进程,但该方法的长期稳定性和泛化能力仍需进一步验证。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→