DeepSeek 的闪存模型降低 AI 内存需求,冲击韩国内存股
好坏参半阅读时间 9 分钟AI 生成的摘要
科技
DeepSeek 公布 V4.1-Flash,一款具有 5520 亿参数的模型,输入激活 80 亿参数、输出激活 160 亿参数,支持一百万标记的上下文窗口并原生读取图像。其架构在各层之间复用缓存,以 4 位精度存储 KV 缓存并按需重建数值,每个标记约产生 890 字节的缓存,自 2024 年 1 月以来内存减少 437 倍。该版本发布及随之而来的定价调整在首尔引发抛压,投资者对 AI 工作负载的单位内存需求定价偏低,导致三星和 SK 海力士股价下跌。
V4.1-Flash 将每个标记的缓存减少到约 890 字节。
背景
自 2024 年 1 月以来,DeepSeek 在多次版本中削减 KV 缓存需求。此举降低了运行长时间 AI 会话所需的内存,并可能降低成本。 Micron 将于 9 月 30…
完整分析
关于这篇报道的 19 个维度 — 全球影响、市场解读,以及接下来会发生什么。
- 完整背景已锁定
- 受影响行业已锁定
- 股市影响已锁定
- 经济指标已锁定
- 投资者相关性已锁定
- 职业相关性已锁定
- 关注要点已锁定
- 变化概率已锁定
- 争议焦点已锁定
- 历史相似案例已锁定
- 前置知识已锁定
- 后续问题已锁定
- 利弊分析已锁定