9月10日·星期四 17:24·来源:36氪

刚刚,DeepSeek新模型上线,长文本缓存硬盘占用暴降88%

DeepSeek新模型已上线,核心优化在于长文本场景下的缓存机制。据披露,该模型通过技术调整,使长文本缓存所需的硬盘占用空间大幅降低88%。这一改进意味着在处理长上下文任务时,存储与硬件成本将显著下降,有助于提升推理效率并降低部署门槛。目前官方尚未公布模型的具体参数规模与完整技术细节,仅确认了缓存压缩方面的量化指标。该优化预计对需要处理大规模长文本的应用场景产生直接影响,例如文档分析、代码库理解及多轮长对话等。后续适配与实测数据有待进一步披露。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→