DeepSeek Strike le Modèle Flash, Réduisant les Besoins en Mémoire AI et Atteignant les Actions Coréennes sur les Mémoire
DeepSeek a annoncé le V4.1-Flash, un modèle de 552 milliards de paramètres activant 8 milliards de paramètres pour l'entrée et 16 milliards pour la sortie, supportant une fenêtre contextuelle d'un million de jetons et lisant les images nativement. Son architecture réutilise le cache entre les couches, stocke le cache KV à une précision de 4 bits et reconstruit les valeurs à la demande, produisant environ 890 octets de cache par jeton et une chute de 437 fois de la mémoire par jeton depuis janvier 2024. La sortie et les changements tarifaires associés ont exercé une pression de vente à Séoul, où Samsung et SK Hynix ont chuté après que les investisseurs ont réévalué la demande de mémoire par unité pour les charges de travail IA.
V4.1-Flash réduit le cache à environ 890 octets par jeton.
Contexte
DeepSeek a réduit les exigences du KV-cache dans plusieurs versions depuis janvier 2024. Cette modification diminue la mémoire nécessaire pour exécuter de longues sessions IA et peut réduire les coûts. Micron publie ses résultats le 30…
L'analyse complète
19 dimensions sur cette actualité — impact mondial, lecture des marchés et la suite.
- Contexte completVerrouillé
- Secteurs concernésVerrouillé
- Impact boursierVerrouillé
- Indicateur économiqueVerrouillé
- Pertinence pour les investisseursVerrouillé
- Pertinence professionnelleVerrouillé
- Points à surveillerVerrouillé
- Probabilité de changementVerrouillé
- Points de débatVerrouillé
- Parallèle historiqueVerrouillé
- Connaissances préalablesVerrouillé
- Questions de suiviVerrouillé
- Pour et contreVerrouillé