DeepSeek のフラッシュモデルは AI メモリ需要を削減し、韓国のメモリ株を揺さぶる

賛否両論読了時間 9 分AIが生成した要約

この記事を報告

問題点をお知らせください。すべての報告を確認します。

この記事を報告
DeepSeek のフラッシュモデルは AI メモリ需要を削減し、韓国のメモリ株を揺さぶる
テクノロジー

Zero Hedge

DeepSeek は V4.1-Flash、5520億パラメータのモデルを発表。入力用に800?億パラメータを活性化し、出力用に160億パラメータを活性化、1,000,000トークンのコンテキストウィンドウをサポートし、画像をネイティブに読み取る。アーキテクチャは層間でのキャッシュを再利用し、KV キャッシュを4ビット精度で保存、要求に応じて値を再構成することで、トークンあたり約890バイトのキャッシュを生成し、2024年1月からトークンあたりのメモリを437倍削減した。このリリースと付随する価格動向はソウルで売り圧力を生み、AI ワークロードの単位メモリ需要の見積が下方修正されたことを受けて Samsung と SK Hynix が下落した。

V4.1-Flash によりキャッシュがトークンあたり約890バイトへ削減された。

背景

DeepSeek は2024年1月以降、複数のリリースで KV キャッシュの要件を削減してきた。この変更は長時間の AI…

詳細な分析

このニュースについての19の観点 — 世界的影響、市場への読み解き、今後の展開。

  • 全体の背景ロック中
  • 影響を受ける業界ロック中
  • 株価への影響ロック中
  • 経済指標ロック中
  • 投資家への関連性ロック中
  • 専門家への関連性ロック中
  • 注目ポイントロック中
  • 変化の可能性ロック中
  • 議論のポイントロック中
  • 歴史的類似事例ロック中
  • 前提知識ロック中
  • フォローアップの質問ロック中
  • メリットとデメリットロック中
無料で読む — クレジットカード不要