DeepSeek 的闪存模型降低 AI 内存需求,冲击韩国内存股

好坏参半阅读时间 9 分钟AI 生成的摘要

举报这篇文章

告诉我们哪里有问题。我们会阅读每一条举报。

举报这篇文章
DeepSeek 的闪存模型降低 AI 内存需求,冲击韩国内存股
科技

Zero Hedge

DeepSeek 公布 V4.1-Flash,一款具有 5520 亿参数的模型,输入激活 80 亿参数、输出激活 160 亿参数,支持一百万标记的上下文窗口并原生读取图像。其架构在各层之间复用缓存,以 4 位精度存储 KV 缓存并按需重建数值,每个标记约产生 890 字节的缓存,自 2024 年 1 月以来内存减少 437 倍。该版本发布及随之而来的定价调整在首尔引发抛压,投资者对 AI 工作负载的单位内存需求定价偏低,导致三星和 SK 海力士股价下跌。

V4.1-Flash 将每个标记的缓存减少到约 890 字节。

背景

自 2024 年 1 月以来,DeepSeek 在多次版本中削减 KV 缓存需求。此举降低了运行长时间 AI 会话所需的内存,并可能降低成本。 Micron 将于 9 月 30…

完整分析

关于这篇报道的 19 个维度 — 全球影响、市场解读,以及接下来会发生什么。

  • 完整背景已锁定
  • 受影响行业已锁定
  • 股市影响已锁定
  • 经济指标已锁定
  • 投资者相关性已锁定
  • 职业相关性已锁定
  • 关注要点已锁定
  • 变化概率已锁定
  • 争议焦点已锁定
  • 历史相似案例已锁定
  • 前置知识已锁定
  • 后续问题已锁定
  • 利弊分析已锁定
免费阅读 — 无需信用卡