8月24日·星期一 21:21·来源:量子位

一篇论文改写AI科研评价规则!中国公司拿出实践数据,双榜第一

一篇论文为AI科研评价体系确立新标准。8月19日,中国AI4S企业深度原理联合微软研究院、斯坦福大学、伯克利等机构发布论文《Measuring AI Scientists: From Exams to Discovery》,首次提出“发现回合”评估体系,全程记录AI在科研周期中的决策轨迹,从假说、执行到结果解读进行综合评分,并强调失败数据对训练和评估的核心价值。该体系旨在替代仅看最终答案的旧有考试模式。深度原理的MIRA平台是该体系的产业样本,其采用多智能体协作、干湿实验室联动的三层架构,在Research Claw Benchmark和Science Agent Arena两项评测中均位列第一,且单项任务平均成本最低。目前,深度原理已依托该平台在锂电、新能源材料等领域布局多条自研管线,由AI主导全周期科研。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(量子位)→