9月4日·星期五 11:03·来源:36氪

4个月4个Flash,Gemini到底在下什么怪棋?

谷歌DeepMind在四个月内连续发布四款Gemini Flash系列轻量级模型,包括2.0 Flash、2.5 Flash、2.5 Flash-Preview和最新版本。该系列主打低延迟与高性价比,主要面向开发者端侧部署场景。最新款模型在推理能力上对标更大参数模型,同时将输入成本降至每百万token约0.3美元,输出成本约2.5美元,较前代大幅下降。市场分析认为,谷歌此举意在通过密集迭代抢占AI推理市场,以轻量模型覆盖高频调用场景,与OpenAI的GPT-4o mini等产品形成直接竞争。Flash系列的技术路线侧重在保持核心性能前提下压缩模型规模,牺牲部分复杂逻辑能力换取响应速度与成本优势,其快速迭代节奏也反映出AI大厂在边缘计算与实时应用领域的军备竞赛正在加剧。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→