DeepSeek: флеш-модель снижает потребность в памяти ИИ и бьёт по корейским акциям памяти

Смешанный9 мин чтенияКраткое изложение, созданное ИИ

Пожаловаться на статью

Расскажите, что не так. Мы читаем каждую жалобу.

Пожаловаться на статью
DeepSeek: флеш-модель снижает потребность в памяти ИИ и бьёт по корейским акциям памяти
Технологии

Zero Hedge

DeepSeek анонсировала V4.1-Flash, модель на 552 миллиарда параметров, которая активирует 8 миллиардов параметров для входа и 16 миллиардов — для выхода, поддерживает контекстное окно на один миллион токенов и читает изображения нативно. Её архитектура повторно использует кеш на разных слоях, хранит KV-кеш в точности 4-бит и реконструирует значения по запросу, создавая примерно 890 байт кеша на токен и 437-кратное снижение памяти на токен с января 2024 года. Выпуск и сопутствующие изменения в ценообразовании вызвали давление на продажи в Сеуле, где акции Samsung и SK Hynix упали после того, как инвесторы заложили меньший спрос на память на единицу для задач ИИ.

V4.1-Flash уменьшает кеш примерно до 890 байт на токен.

Контекст

DeepSeek снижает требования к KV-кешу в нескольких релизах с января 2024 года. Это изменение уменьшает потребление памяти для длительных ИИ-сессий и может снизить издержки. Micron опубликует отчёт о прибылях 30 сентября, и прогнозы спроса…

Полный анализ

19 параметров этой новости — мировое влияние, оценка рынка и что будет дальше.

  • Полный контекстЗаблокировано
  • Затронутые отраслиЗаблокировано
  • Влияние на биржуЗаблокировано
  • Экономический показательЗаблокировано
  • Значимость для инвесторовЗаблокировано
  • Профессиональная значимостьЗаблокировано
  • На что обратить вниманиеЗаблокировано
  • Вероятность измененийЗаблокировано
  • Спорные моментыЗаблокировано
  • Исторические параллелиЗаблокировано
  • Необходимые базовые знанияЗаблокировано
  • Вопросы для дальнейшего изученияЗаблокировано
  • Плюсы и минусыЗаблокировано
Читать бесплатно — без банковской карты