9月1日·星期二 07:00·来源:InfoQ

智能体请求暴增9.4倍,token账单却没涨:Uber 公开AI软件工厂省钱方法

Uber在2026年AI工程师大会上披露其AI软件工厂成本控制方法。目前超70%代码合并请求由智能体生成,工程师已构建超3600个智能体技能,日均调用超3万次。2026年2月至8月,周活跃用户增长7倍,周智能体请求量增长9.4倍,但AI总支出自4月起保持稳定。通过固定模型对照测试,每千次请求成本较峰值下降近34%,单会话成本较6月峰值下降52%。Uber将AI使用分为四个层级,并将总支出分解为六个可独立优化的项。主要手段包括:基于真实业务任务构建基准测试进行模型选型,为各工作负载选择帕累托最优模型;将子智能体默认设置为性价比更高的模型;自动压缩40万token以上上下文;推理强度默认设为中等。Uber强调,成本降幅因环境而异,但基于真实业务基准测试、围绕准确率与成本优化的方法论具有普适性。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(InfoQ)→