• 存储需求
12026-09-16 00:02:42

DeepSeek发布V4.1-Flash,基于HBM的KV缓存需求降低75%至890bytes/token。模型效率提升降低推理成本,利好AI应用,但或压制HBM需求预期。关注算力产业链分化。