Mazda CX5
Як зробити цифрову копію себе. Ось відео —>

DeepSeek випустила мультимодальну модель V4.1-Flash із меншим споживанням пам'яті та рекордною швидкістю

Китайська ШІ-компанія DeepSeek презентувала нову модель DeepSeek-V4.1-Flash. Новинка побудована на архітектурі Mixture-of-Experts (MoE) загальним обсягом 552 млрд параметрів та має нативну підтримку аналізу візуальних даних. За заявою розробників, V4.1-Flash є найменшою у новій лінійці архітектур, проте перевершує за продуктивністю та економічністю попередні флагмани.

Залишити коментар
DeepSeek випустила мультимодальну модель V4.1-Flash із меншим споживанням пам'яті та рекордною швидкістю

Китайська ШІ-компанія DeepSeek презентувала нову модель DeepSeek-V4.1-Flash. Новинка побудована на архітектурі Mixture-of-Experts (MoE) загальним обсягом 552 млрд параметрів та має нативну підтримку аналізу візуальних даних. За заявою розробників, V4.1-Flash є найменшою у новій лінійці архітектур, проте перевершує за продуктивністю та економічністю попередні флагмани.

Архітектура та технічні особливості

Завдяки використанню нової архітектури Causal Encoder-Decoder модель використовує лише 8 млрд активних параметрів для вводу та 16 млрд для виводу, повідомляє Neowin. Завдяки новим методам попереднього навчання та масштабному навчанню з підкріпленням (RL), V4.1-Flash показала результати у бенчмарках, що перевищують показники таких моделей, як Kimi-K3, GLM-5.3, Claude Opus 5, GPT 5.6-Sol та власної попередниці DeepSeek-V4-Pro.

Розробники також суттєво зменшили навантаження на апаратні ресурси.  Моделі потрібно у 4 рази менше високосмугової пам’яті (HBM) та у 8 разів менше місця на SSD-накопичувачах для зберігання KV-кешу порівняно з минулим поколінням.

Стиснення кешу дозволяє суттєво зменшити витрати на роботу ШІ-агентів, оскільки зчитування кешу становить значну частку загальної вартості запитів.

Зміни в API та виведення з експлуатації старих моделей

DeepSeek-V4.1-Flash вже доступна через офіційний API. У зв’язку з релізом компанія виводить з експлуатації застарілі моделі:

  • запити до V4-Flash та V4-Flash-Vision-Exp автоматично перенаправляються на V4.1-Flash;

  • модель V4-Pro також поступово згортається через повну перевагу V4.1-Flash за швидкістю, ціною та якістю. З 14 вересня (04:00 UTC) усі запити до V4-Pro перенаправлятимуться на V4.1-Flash за тарифами нової моделі — аж до релізу майбутньої V4.1-Pro.

Підтримку V4.1-Flash вже інтегрували офіційні партнери компанії — WorkBuddy_AI та OpenCode, що дозволяє використовувати модель для вайб-кодингу одразу після релізу. Оскільки модель поширюється з відкритим вихідним кодом, найближчим часом очікується її інтеграція багатьма іншими розробниками галузі.

DeepSeek навчила V4 Flash «бачити» зображення. Чому на їхню обробку потрібно менше токенів ніж у моделей-конкурентів?
DeepSeek навчила V4 Flash «бачити» зображення. Чому на їхню обробку потрібно менше токенів, ніж у моделей-конкурентів?
По темi
DeepSeek навчила V4 Flash «бачити» зображення. Чому на їхню обробку потрібно менше токенів, ніж у моделей-конкурентів?
DeepSeek представив нову модель V4 та обвалив акції конкурентів
DeepSeek представив нову модель V4 та обвалив акції конкурентів
По темi
DeepSeek представив нову модель V4 та обвалив акції конкурентів
Читайте головні IT-новини країни в нашому Telegram
Читайте головні IT-новини країни в нашому Telegram
По темi
Читайте головні IT-новини країни в нашому Telegram
Читайте також
Штучний інтелект DALL-E навчився домальовувати картини. Як це виглядає
Штучний інтелект DALL-E навчився домальовувати картини. Як це виглядає
Штучний інтелект DALL-E навчився домальовувати картини. Як це виглядає
2 коментарі
Штучний інтелект почав озвучувати фільми на MEGOGO
Штучний інтелект почав озвучувати фільми на MEGOGO
Штучний інтелект почав озвучувати фільми на MEGOGO
6 коментарів
Штучний інтелект навчився реставрувати старі фотографії, перетворюючи їх на якісні зображення: відео
Штучний інтелект навчився реставрувати старі фотографії, перетворюючи їх на якісні зображення: відео
Штучний інтелект навчився реставрувати старі фотографії, перетворюючи їх на якісні зображення: відео
2 коментарі
«Чи є у мене талант, якщо комп’ютер може імітувати мене?». Штучний інтелект пише книги авторам Amazon Kindle. The Verge поспілкувався з авторами та виявив багато цікавого
«Чи є у мене талант, якщо комп’ютер може імітувати мене?». Штучний інтелект пише книги авторам Amazon Kindle. The Verge поспілкувався з авторами та виявив багато цікавого
«Чи є у мене талант, якщо комп’ютер може імітувати мене?». Штучний інтелект пише книги авторам Amazon Kindle. The Verge поспілкувався з авторами та виявив багато цікавого
Письменники-романісти використовують штучний інтелект для створення своїх творів. Видання про технології The Verge поспілкувалося з письменницею Дженніфер Лепп, яка випускає нову книгу кожні дев’ять тижнів, й дізналося про те, як працює штучний інтелект для написання романів. Наводимо адаптований переклад статті. 

Хочете повідомити важливу новину? Пишіть у Telegram-бот

Головні події та корисні посилання в нашому Telegram-каналі

Обговорення
Коментарів поки немає.