闭源RSI的严父:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5
开源AI基础设施公司Prime Intellect近日发布研究,提出借助多智能体Harness框架,用更小、更便宜的开源模型承担监控与实现环节,可降低“AI开发AI”成本并提升效果。实验中,18个前沿模型参与nanoGPT优化器速通任务,开源模型Kimi K3搭配Prime Agent Harness后,以2930步的成绩超过GPT-5.6 Sol的3042步,距Claude旗舰Opus 5的2920步仅差10步。研究显示,系统级试错效率比模型本身强弱更关键,强模型更善于坚持验证弱信号并自行构建工具。该结果动摇了“最强闭源模型赢家通吃”的经典RSI叙事,表明高效Harness可使开源模型逼近乃至超越顶级闭源模型。Prime Intellect计划将Speedrun扩展至训练栈更多环节,并继续扩大实验规模。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(量子位)→
