DeepSeek のフラッシュモデルは AI メモリ需要を削減し、韓国のメモリ株を揺さぶる
賛否両論読了時間 9 分AIが生成した要約
テクノロジー
DeepSeek は V4.1-Flash、5520億パラメータのモデルを発表。入力用に800?億パラメータを活性化し、出力用に160億パラメータを活性化、1,000,000トークンのコンテキストウィンドウをサポートし、画像をネイティブに読み取る。アーキテクチャは層間でのキャッシュを再利用し、KV キャッシュを4ビット精度で保存、要求に応じて値を再構成することで、トークンあたり約890バイトのキャッシュを生成し、2024年1月からトークンあたりのメモリを437倍削減した。このリリースと付随する価格動向はソウルで売り圧力を生み、AI ワークロードの単位メモリ需要の見積が下方修正されたことを受けて Samsung と SK Hynix が下落した。
V4.1-Flash によりキャッシュがトークンあたり約890バイトへ削減された。
背景
DeepSeek は2024年1月以降、複数のリリースで KV キャッシュの要件を削減してきた。この変更は長時間の AI…
詳細な分析
このニュースについての19の観点 — 世界的影響、市場への読み解き、今後の展開。
- 全体の背景ロック中
- 影響を受ける業界ロック中
- 株価への影響ロック中
- 経済指標ロック中
- 投資家への関連性ロック中
- 専門家への関連性ロック中
- 注目ポイントロック中
- 変化の可能性ロック中
- 議論のポイントロック中
- 歴史的類似事例ロック中
- 前提知識ロック中
- フォローアップの質問ロック中
- メリットとデメリットロック中