DeepSeek V4.1 Flash Preview: скорость, цены API и доступ
DeepSeek V4.1 Flash вступает в тестирование: заявленные 300-507 токенов/с, цены V4 Flash и временный идентификатор модели. APIMaster объясняет, что нужно знать разработчикам.
Published 2026-09-08
DeepSeek V4.1 Flash вступил в ограниченное тестирование 8 сентября 2026 года, согласно отчету Zhidx. Его временный идентификатор модели — deepseek-v4.1-flash-expires-on-0910. В отчете говорится, что существующие разработчики DeepSeek могут сохранить свой базовый URL, использовать новый идентификатор модели и отправлять до 20 одновременных запросов на аккаунт. Текущая тарификация соответствует V4 Flash. Сообщается, что примеры из сообщества достигали 300-507 выходных токенов/с, но это отдельные наблюдения, а не бенчмарк APIMaster или гарантированная скорость сервиса.
В APIMaster мы рассматриваем этот релиз как полезную возможность оценить скорость ответов моделей, мультимодальные рабочие процессы и стоимость API вместе. По состоянию на нашу проверку публичного каталога 8 сентября, APIMaster включает V4 Flash, V4 Pro и V4 Flash Vision Exp; идентификатор предварительной версии V4.1 Flash не был указан. Вы можете создать аккаунт APIMaster, чтобы начать работу с доступными моделями DeepSeek и сравнить текущие варианты в нашем маркетплейсе моделей.
Что нового в DeepSeek V4.1 Flash?
В отчете от 8 сентября описывается промежуточная версия V4.1 Flash, использующая новую архитектуру модели, с нативной мультимодальной поддержкой, более сильными возможностями, более быстрыми ответами и более низкими затратами. Это ранний тестовый релиз, поэтому к этим заявлениям следует относиться с учетом этого контекста.
Для разработчиков интерес представляет комбинация большей функциональности по той же опубликованной цене API. Более низкие внутренние затраты на модель не автоматически означают более низкий счет для клиента: текущая предварительная версия тарифицируется по ставкам V4 Flash.
В отчете не указаны контекстное окно, максимальная длина выходных данных, поддерживаемые форматы изображений, аудио- или видеоинтерфейсы, а также подробные оценочные показатели. Нативная мультимодальность сама по себе не гарантирует поддержку всех типов медиа. Мы бы проверили фактический интерфейс и протестировали репрезентативные входные данные перед проектированием приложения на основе этих возможностей.
Насколько это быстро? Понимание отчета о 507 токенах/с
Zhidx ссылается на разработчиков, публикующих свой опыт в X. Один сообщил о пиковой скорости вывода 507 токенов/с. Другой получил 328 токенов/с при генерации HTML-страницы с SVG-анимацией пеликана на велосипеде; отдельный разработчик сообщил о среднем значении выше 300 токенов/с при аналогичной задаче.
Это многообещающе для генерации кода, длинных ответов и интерактивных ассистентов. Это еще не контролируемое сравнение: в статье не приводится общий метод измерения, полные настройки запроса или воспроизводимое распределение результатов.
В APIMaster мы рекомендуем рассматривать три измерения вместе:
| Измерение | Что оно показывает |
|---|---|
| Время до первого токена | Как долго пользователь ждет начала ответа |
| Выходные токены в секунду | Как быстро приходит ответ после начала генерации |
| Общее время выполнения и корректность | Завершается ли вся задача быстро и дает ли полезный результат |
Иллюстрация, а не бенчмарк: ответ из 1000 токенов при устойчивой скорости 300 токенов/с занимает около 3,3 секунды генерации вывода. При 507 токенах/с это около 2,0 секунд. Ни один из расчетов не включает очередь, начальную обработку, время рассуждения или сетевые задержки. Более быстрый поток ценен, но сам по себе не доказывает более быстрый или более точный полный рабочий процесс.
Цены API DeepSeek V4.1 Flash
В отчете говорится, что предварительная версия использует те же цены, что и DeepSeek V4 Flash. Все суммы ниже указаны в китайских юанях (CNY/RMB) за один миллион токенов, а не в долларах США и не являются ценами маршрутов APIMaster.
| Тип токенов | Цена вне пика (CNY / 1 млн токенов) | Пиковая цена (CNY / 1 млн токенов) |
|---|---|---|
| Входные данные с попаданием в кэш | 0.05 | 0.10 |
| Входные данные без попадания в кэш | 1.50 | 3.00 |
| Выходные данные | 4.50 | 9.00 |
Пример стоимости: 1 миллион входных токенов без попадания в кэш плюс 1 миллион выходных токенов будет стоить CNY 6 вне пика или CNY 12 по пиковым ставкам, используя указанные цены. Пример исключает другое использование и предполагает, что все входные данные не попадают в кэш.
В предоставленном отчете не определено расписание пиковых часов или их часовой пояс. Проверьте текущую документацию по выставлению счетов DeepSeek перед планированием рабочих нагрузок. Для использования APIMaster обратитесь к актуальной цене модели и маршрута, указанной в маркетплейсе; приведенная выше таблица апстрима не является котировкой для нашего сервиса.
Как получить доступ к предварительной версии, и что означает 0910?
Для подходящих разработчиков, использующих собственный API DeepSeek, сообщаемое изменение простое:
model = deepseek-v4.1-flash-expires-on-0910
base_url = keep your existing DeepSeek base URL
account concurrency limit = 20
Эта инструкция относится к апстрим-предварительной версии DeepSeek. Она не гарантирует доступность через каждый сторонний шлюз, и лимит в 20 запросов не является опубликованным лимитом аккаунта APIMaster.
Название модели предполагает истечение срока действия 10 сентября 2026 года. Zhidx делает вывод о дате отключения из этого названия; предоставленный текст не указывает точное время или часовой пояс. Относитесь к идентификатору как к временному и подтвердите текущее уведомление апстрима, прежде чем полагаться на него.
Мы рекомендуем оставить имя модели настраиваемым, оценить небольшой набор реальных задач и сохранить проверенную альтернативу. После периода предварительной версии используйте текущий поддерживаемый идентификатор, а не предполагайте, что модель expires-on-0910 останется доступной или автоматически сопоставится с преемником.
Где это вписывается в недавние релизы DeepSeek
В отчете V4.1 Flash помещается в быструю серию обновлений моделей и инструментов для разработчиков:
| Дата в 2026 году | Обновление, о котором сообщает Zhidx |
|---|---|
| 31 июля | API производственной версии V4 Flash вступил в публичное тестирование |
| 13 августа | Выпущен API производственной версии V4 Pro; предварительная версия DeepSeek Harness v0.1 для разработчиков вступила в публичное тестирование и была открыта |
| 19 августа | DeepSeek Harness обновлен до v0.1.0-rc.8 |
| 21 августа | V4 Flash Vision Exp запущен на платформе API |
| 31 августа | V4 Flash Vision Exp был открыт |
| 8 сентября | Промежуточная версия V4.1 Flash вступила в ограниченное тестирование |

Репозиторий DeepSeek Harness на GitHub. Это не тест скорости V4.1 Flash.
С нашей точки зрения, практический вывод заключается в том, что у разработчиков теперь есть несколько разных вещей для оценки: Flash для текстовых рабочих нагрузок, Pro как еще один вариант модели, Vision Exp для задач, связанных с изображениями, и новая временная предварительная версия для ранних экспериментов. Хронология релизов предполагает продолжающуюся разработку; она не подтверждает дату финального релиза V4.1.
Начните использовать DeepSeek с APIMaster
Отслеживание новых релизов моделей должно приводить к чему-то, что можно создать. APIMaster объединяет DeepSeek и другие семейства моделей в одну консоль и API, совместимый с OpenAI, что позволяет сравнивать поддерживаемые модели без поддержки отдельной интеграции для каждого провайдера.
Наша проверка публичного каталога 8 сентября 2026 года вернула deepseek-v4-flash, deepseek-v4-pro и deepseek-v4-flash-vision-exp. Временный идентификатор deepseek-v4.1-flash-expires-on-0910 отсутствовал в этом результате. Проверьте живой маркетплейс на предмет текущей доступности и цен перед выбором модели.
Чтобы начать:
- Зарегистрируйтесь в APIMaster.
- Выберите доступную модель и ознакомьтесь с ее текущей ценой и поддерживаемым интерфейсом.
- Откройте консоль, пополните баланс при необходимости и создайте свой ключ API.
- Настройте приложение с базовым URL APIMaster и выбранным идентификатором модели.
- Отправьте небольшой запрос, проверьте результат и использование, затем масштабируйте под свою рабочую нагрузку.
Вот текстовый пример с использованием текущей указанной V4 Flash, а не временной предварительной версии:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["APIMASTER_API_KEY"],
base_url="https://apimaster.ai/v1",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{"role": "user", "content": "Write a Python function that validates an email address."}
],
)
print(response.choices[0].message.content)
Подробнее о настройке читайте в нашем руководстве по API DeepSeek и руководстве по ключам API. Вы также можете использовать наш тестер API DeepSeek, чтобы проверить подключение и ответы. Успешный тест подключения сам по себе не подтверждает идентичность модели и не устанавливает бенчмарк производительности.
FAQ
Каков идентификатор модели предварительной версии DeepSeek V4.1 Flash?
Сообщаемый идентификатор — deepseek-v4.1-flash-expires-on-0910. Он принадлежит временному промежуточному тестовому релизу, анонсированному в отчете от 8 сентября 2026 года.
Дешевле ли V4.1 Flash, чем V4 Flash?
Согласно отчету, текущая цена API предварительной версии такая же, как у V4 Flash. Входные данные без попадания в кэш вне пика стоят CNY 1.50 за миллион токенов, а выходные данные — CNY 4.50; пиковые цены составляют CNY 3.00 и CNY 9.00 соответственно. Это указанные цены апстрима, а не котировки APIMaster.
Гарантирует ли DeepSeek V4.1 Flash скорость 507 токенов/с?
Нет. Показатель 507 токенов/с — это индивидуальный результат из сообщества, на который ссылается Zhidx. APIMaster не представил независимый бенчмарк V4.1 Flash в этой статье, и фактическая производительность зависит от настроек запроса, рабочей нагрузки и условий сервиса.
Доступна ли предварительная версия V4.1 Flash на APIMaster?
Она не была указана в нашей проверке публичного каталога 8 сентября 2026 года. Были указаны V4 Flash, V4 Pro и V4 Flash Vision Exp. Обратитесь к живому маркетплейсу для получения информации о последующих изменениях доступности.
Когда истекает срок действия временной модели?
Название предполагает 10 сентября 2026 года. Предоставленный отчет делает вывод об этой дате из идентификатора модели и не указывает точное время или часовой пояс. Подтвердите текущее уведомление DeepSeek и держите альтернативную модель наготове.
Превратите новости о моделях в свой следующий проект
Предварительную версию V4.1 Flash стоит отслеживать из-за заявленной скорости и мультимодального направления. Для работы, которую вы хотите начать сегодня, выберите доступную в настоящее время модель, измерьте результаты на своих собственных задачах и стройте дальше.
Создайте свой аккаунт APIMaster, чтобы изучить DeepSeek и другие поддерживаемые модели, сравнить текущие цены API и отправить свой первый запрос через один знакомый интерфейс.
Сравнивайте маршруты со скидками и оплачивайте фактическое использование API; экономия зависит от выбранной модели и маршрута.