DeepSeek выпустила V4.1-Flash и продлила API DeepSeek V4 Pro после 14 сентября 2026
DeepSeek объявила два важных изменения: выпуск новой модели DeepSeek-V4.1-Flash — лёгкой быстрой версии флагмана — и продление API-доступа к DeepSeek V4 Pro после 14 сентября 2026 по запросу пользователей. V4.1-Flash ориентирована на задачи с низкой латентностью при цене значительно ниже V4 Pro.
Неделя 7–14 сентября 2026 года. Китайская лаборатория DeepSeek продолжает активный релизный цикл: новая Flash-модель и сохранение доступа к Pro-версии по запросам рынка.
DeepSeek-V4.1-Flash — что это: ``` Позиционирование: → Лёгкая, быстрая версия DeepSeek V4 → Для задач с требованием низкой латентности → Аналог: Claude Haiku vs Opus, GPT-4o-mini vs GPT-6
Предполагаемые характеристики: Параметры: MoE-архитектура, ~20-40B активных Контекст: 128K токенов Latency: ~2–4x быстрее V4 Pro Цена: ~5–10x дешевле V4 Pro за токен
Целевые use cases: → Чат-боты с высокой нагрузкой → Real-time autocomplete в IDE → Быстрая классификация документов → Аналитические пайплайны с массовой обработкой ```
DeepSeek V4 Pro: API продлён: ``` Ситуация: → DeepSeek планировала прекратить поддержку V4 Pro по окончании периода поддержки → Пользователи подали запросы на продление → DeepSeek решила сохранить API V4 Pro «по многочисленным просьбам»
Что не меняется: → Billing method остаётся прежним → API endpoint без изменений → SLA поддержки — как прежде
Что значит для рынка: → DeepSeek V4 Pro остаётся в топ-5 global (Real-SWE benchmark: 28.4%) → Конкурентоспособность на уровне Claude Sonnet 5 при значительно меньшей цене ```
Контекст: DeepSeek в санкционном давлении: ``` Ситуация с санкциями (август–сентябрь 2026): → NSA/CISA/ФБР: DeepSeek в списке шести китайских компаний с обвинением в «дистилляции» американских моделей → DeepSeek отрицает обвинения → API: продолжает работу в штатном режиме
Для российских пользователей: → DeepSeek доступен без ограничений → Серверы в Китае → 152-ФЗ требует оценки при передаче ПД российских граждан → Для работы с обезличенными / неперсональными данными — юридических рисков нет ```
Сравнение DeepSeek V4.1-Flash с конкурентами: ``` Модель Скорость Цена (вход) Качество ────────────────────────────────────────────────── Gemini 3.8 Flash ████████ $0.075/1M ★★★★☆ Claude Haiku 4.5 ███████ $0.08/1M ★★★★☆ GPT-6 nano ██████ $0.09/1M ★★★☆☆ DeepSeek V4.1-Flash ████████ $0.05/1M ★★★★☆ (ожид.)
(Цены и оценки приблизительные) ```
Для российских разработчиков: DeepSeek-V4.1-Flash — интересный выбор для высоконагруженных B2B-пайплайнов с нечувствительными к локализации данными. GigaChat Lite и Alice AI LLM Lite — российские альтернативы для случаев с ПД граждан РФ.
Это краткое изложение. Полный текст статьи доступен на сайте источника:
Читать полностью на LLM-Stats / PricepertokenЕщё по теме ai-трансформация
Fable 5.1 лидирует в Real-SWE бенчмарке с 38,8% против GPT-6 Astra (33,8%) и Gemini 3.8 Flash (31,2%)
Meta разворачивает «плоскую» организацию Applied AI: IC-сотрудников просят вернуться в роль менеджеров
Claude Fable 5.1: кэш-чтение подешевело на 75%, три breaking changes — что изменилось с 1 сентября 2026
Хотите узнать, как это применимо к вашему бизнесу?
Рассчитаем ROI от AI за 60 минут. Покажем конкретные метрики для вашей отрасли.
