DeepSeek发布新模型:相比上一代对HBM的需求减少到1/4 对SSD的需求减少到1/8

DeepSeek发布新模型:相比上一代对HBM的需求减少到1/4 对SSD的需求减少到1/8

  10日,DeepSeek正式发布DeepSeek V4.1 Flash模型 。这是公司全新模型结构系列中的最小尺寸的模型 ,具备原生多模态视觉理解能力。

  据介绍,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比 ,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高 ,对KV Cache的压缩大幅降低了Agent类任务的使用成本 。

  费用 方面,DeepSeek下调了V4.1 Flash的定价。近来 采用峰谷定价,闲时费用 为高峰时段费用 的一半 ,鼓励用户根据实际使用情况调整任务时间。新费用 已于2026年9月10日12:00开始生效 。

(文章来源:中新经纬)

©版权声明
THE END