Содержание 3
Компания DeepSeek официально уведомила, что новая модель выйдет уже завтра — «в районе 10 сентября». Только это не V4 и не нашумевшая в слухах R2, а DeepSeek V4.1 Flash. По заявлению компании, после внутренних и внешних тестов модель превосходит V4 Pro по качеству, цене и скорости сразу, а значит, до выхода старшей версии трафик V4 Pro автоматически начнут направлять на Flash по её тарифу. Что важно — анонс касается API-платформы, и про открытые веса в нём речи нет.
Что известно
V4.1 Flash построена на новой архитектуре с нативной мультимодальностью — это развитие экспериментальной ветки v4-flash-vision, то есть модель из коробки понимает не только текст, но и изображения. Имя беты, которое уже появилось в платформе, — deepseek-v4.1-flash-expires-on-0910, что прямо указывает на дату. По неофициальным данным сообщества, модель работает заметно быстрее: около 400 токенов в секунду, а retrieval и код — в разы быстрее предшественников.
Точное число параметров и архитектурные детали компания не раскрыла, как и не подтвердила open-source-релиз: уведомление описывает исключительно API. Формулировка про дату тоже не жёсткая — «около 10 сентября», но по факту ждать стоит именно завтра.
Цены API
С 10 сентября в 12:00 по Пекину вступает Flash-тариф, и он заметно агрессивнее: вход с попаданием в кэш — ¥0,02 за миллион токенов, вход без кэша — ¥1 за миллион, выход — ¥4 за миллион, а в пиковые часы всё умножается на два. Для сравнения, у многих конкурентов выход стоит в десятки раз дороже. Понятно, что DeepSeek продолжает давить на рынок ценой — вопрос лишь, сколько сможет выдержать сама компания при такой себестоимости.
Почему это важно
Для разработчиков API DeepSeek доступен и из Беларуси, а удешевление инференса напрямую режет себестоимость LLM-продуктов местных команд: модель, способная работать с изображениями и текстом по цене несколько юаней за миллион токенов, меняет экономику небольших ИИ-сервисов. Отдельно заметно, что выход происходит на фоне обвинений США в адрес DeepSeek и других китайских компаний в «дистилляции» американских моделей — о бюллетене NSA, CISA и ФБР мы писали отдельно. Реакция китайских производителей на это давление, судя по всему, одна — ускорять выпуск собственных моделей.
Тема безопасности и гонки в ИИ-индустрии у нас уже поднималась, когда исследователь Anthropic публично уволился с критикой безответственной спешки. DeepSeek, напротив, спешит в другом смысле — в скорости вывода новых версий.




