DeepSeek: флеш-модель снижает потребность в памяти ИИ и бьёт по корейским акциям памяти
DeepSeek анонсировала V4.1-Flash, модель на 552 миллиарда параметров, которая активирует 8 миллиардов параметров для входа и 16 миллиардов — для выхода, поддерживает контекстное окно на один миллион токенов и читает изображения нативно. Её архитектура повторно использует кеш на разных слоях, хранит KV-кеш в точности 4-бит и реконструирует значения по запросу, создавая примерно 890 байт кеша на токен и 437-кратное снижение памяти на токен с января 2024 года. Выпуск и сопутствующие изменения в ценообразовании вызвали давление на продажи в Сеуле, где акции Samsung и SK Hynix упали после того, как инвесторы заложили меньший спрос на память на единицу для задач ИИ.
V4.1-Flash уменьшает кеш примерно до 890 байт на токен.
Контекст
DeepSeek снижает требования к KV-кешу в нескольких релизах с января 2024 года. Это изменение уменьшает потребление памяти для длительных ИИ-сессий и может снизить издержки. Micron опубликует отчёт о прибылях 30 сентября, и прогнозы спроса…
Полный анализ
19 параметров этой новости — мировое влияние, оценка рынка и что будет дальше.
- Полный контекстЗаблокировано
- Затронутые отраслиЗаблокировано
- Влияние на биржуЗаблокировано
- Экономический показательЗаблокировано
- Значимость для инвесторовЗаблокировано
- Профессиональная значимостьЗаблокировано
- На что обратить вниманиеЗаблокировано
- Вероятность измененийЗаблокировано
- Спорные моментыЗаблокировано
- Исторические параллелиЗаблокировано
- Необходимые базовые знанияЗаблокировано
- Вопросы для дальнейшего изученияЗаблокировано
- Плюсы и минусыЗаблокировано