Содержание 4
DeepSeek официально раскрыла характеристики своей новой модели V4.1 Flash — той самой, что вышла несколько дней назад и вызвала много вопросов из-за скудного официального описания. Теперь опубликованы технические детали, и они объясняют, почему компания так уверенно заявляла о превосходстве новинки над прошлым флагманом.
Архитектура и масштаб
V4.1 Flash построена на смеси экспертов: 552 млрд параметров, из которых активны лишь часть — примерно 8 млрд на входе и 16 млрд на выходе. Асимметрия необычная, но объяснимая: обработка запроса и генерация ответа требуют разного объёма вычислений. Использована новая архитектура с разделением на кодировщик и декодировщик, а обучение включало большой этап подкрепления. Контекст заявлен до одного миллиона токенов, а максимальная длина ответа — до 384 тысяч токенов.
Почему это дешевле
Отдельно подчёркивается экономия памяти: кэш длинных контекстов занимает примерно вчетверо меньше памяти и в восемь раз меньше места на накопителях, чем у предыдущего поколения. Для практики это означает, что длинные тексты и многошаговые агентские сценарии становятся ощутимо доступнее — именно на них раньше уходила основная часть бюджета. Цены API снижены: попадание в кэш подешевело примерно на 60%, вход — на треть, выход — немногим более 10%. В пиковые часы тарифы вдвое выше.
Зрение и мультимодальность
Модель нативная мультимодальная: она понимает изображения, распознаёт текст на скриншотах и анализирует графики. Картинку можно передать ссылкой, в виде данных или через файловый API. Раньше у DeepSeek для этого существовала отдельная экспериментальная сборка с внешним кодировщиком — теперь зрение встроено в базовую архитектуру, и отдельная модель больше не нужна.
Что будет с V4 Pro
Ключевое практическое изменение: с 14 сентября все запросы к V4 Pro будут направляться на V4.1 Flash и тарифицироваться по его ценам — до выхода V4.1 Pro. Старые интеграции при этом не сломаются, поскольку имена моделей маршрутизируются автоматически. Для разработчиков это означает, что платить за прежний флагманский уровень больше не нужно, а длинные контексты с кэшированием станут заметно дешевле. В Беларуси API DeepSeek доступен, так что изменения затрагивают и местных разработчиков.
По теме: V4.1 Flash: первый анонс, DeepSeek V4.1 Pro: сроки, США и китайские ИИ-компании.
Текст TehnoRex. Дата: 2026-09-10.




