На 26 августа 2026 года в официальном API DeepSeek есть три актуальных маршрута: deepseek-v4-flash, deepseek-v4-pro и экспериментальный deepseek-v4-flash-vision-exp. Поэтому привычное сравнение R1 и V3 уже не отвечает на вопрос, какую модель указывать в новом приложении.
Практическая стратегия выглядит так: V4 Flash — базовый кандидат для текста и обычных агентных процессов, V4 Pro — сравниваемый уровень для сложного кода, рассуждения и длинной работы с инструментами, а Vision Exp нужен только при реальном входе в виде изображений. Название Pro или новая дата релиза сами по себе не являются критерием.
Веб-чат DeepSeek, официальный API, открытые веса и модель с похожим названием у стороннего сервиса — разные продукты. Их цены, доступность и поведение нельзя переносить друг на друга.
Актуальная линейка без исторических дублей
В официальном руководстве по первому запросу текущие текстовые ID соответствуют версиям V4-Flash-0731 и V4-Pro-0813. Vision Exp появился на API-платформе 21 августа и прямо обозначен как экспериментальный.
| Модель API | Разумная первая задача | Главная граница |
|---|---|---|
deepseek-v4-flash | Диалоги, извлечение, преобразование, JSON, код, недорогие агенты | На самых сложных знаниях и длинных агентных цепочках Pro может дать полезный разрыв |
deepseek-v4-pro | Сложный код, высокий ущерб от ошибки, многошаговые инструменты, трудные профессиональные задачи | При одинаковом времени и состоянии кэша токены стоят примерно втрое дороже Flash |
deepseek-v4-flash-vision-exp | Скриншоты, диаграммы, сканы, визуальное состояние приложения | Экспериментальный статус требует проверки, мониторинга версии и запасного пути |
По журналу изменений DeepSeek V4 Pro получил статус GA 13 августа сразу в приложении, вебе и API. Но это не означает, что интерфейсы имеют одинаковые лимиты и договор. Для программной интеграции нужно опираться именно на документацию API.
Большой контекст не выбирает модель за вас
Для всех трёх маршрутов таблица моделей и цен указывает контекст 1 миллион токенов и максимальный вывод 384 тысячи токенов. Все поддерживают JSON, инструменты, Responses API и Anthropic-совместимый интерфейс. FIM работает только у текстовых моделей без thinking; Vision Exp его не поддерживает.
Следовательно, запрос «нужен длинный контекст» не даёт автоматического ответа Pro. В тесте следует измерять, находит ли модель нужный фрагмент, соблюдает ли инструкции после длинного ввода, не теряет ли состояние инструментов и не раздувает ли вывод.
Открытые веса — отдельное решение. В официальном репозитории V4 у Pro указано 1,6 трлн общих и 49 млрд активируемых параметров, у Flash — 284 млрд и 13 млрд. Веса доступны по MIT. Но скорость, качество квантования, требования к памяти и совместимость инструментов зависят от выбранного оборудования и сервера; спецификация весов не гарантирует поведение хостингового API.
Цена — это модель, кэш, время и длина ответа
В будни DeepSeek использует пиковые периоды 01:00–04:00 и 06:00–10:00 UTC. В остальное время действует половинная непиковая ставка. Ниже — официальные цены в долларах за миллион токенов, проверенные 26 августа 2026 года.
| Маршрут | Период | Ввод, попадание кэша | Ввод, промах кэша | Вывод |
|---|---|---|---|---|
| Flash / Vision Exp | Непиковый | $0.007 | $0.22 | $0.66 |
| Flash / Vision Exp | Пиковый | $0.014 | $0.44 | $1.32 |
| Pro | Непиковый | $0.022 | $0.66 | $1.98 |
| Pro | Пиковый | $0.044 | $1.32 | $3.96 |
Нельзя сравнивать модели только по минимальной цене кэшированного ввода. Например, 300 тысяч некэшированных входных токенов и 30 тысяч выходных токенов в непиковое время стоят примерно $0.0858 на Flash и $0.2574 на Pro. Это цена одного вызова, а не принятого результата. Если Pro заметно уменьшает повторные попытки и ручное исправление, итоговая экономика может измениться.
Thinking — режим, а не отдельная модель R1

V4 Flash и V4 Pro поддерживают выключенный thinking и уровни low, high, max. В официальном контракте thinking mode режим включён по умолчанию с уровнем high; значения совместимости medium и xhigh сейчас также отображаются в high.
Корректное сравнение меняет одну переменную за раз. Сначала найдите минимальную интенсивность, при которой Flash проходит критерии. Затем при том же уровне сравните Pro. Иначе результат Flash-low против Pro-max ничего не говорит о разнице моделей.
Есть и технические последствия. В thinking mode параметры temperature, top_p, presence_penalty и frequency_penalty игнорируются. В многоходовом сценарии с tools нужно возвращать reasoning_content в следующих запросах по официальной схеме, иначе API может ответить 400.
Когда оправдан Vision Exp
Vision API принимает JPEG, PNG, GIF и WebP через base64, внешний URL или Files API. Обычные Pro и Flash изображения не принимают.
Vision Exp имеет смысл для разбора скриншота ошибки, чтения диаграммы, извлечения данных из скана и агента, который должен учитывать видимое состояние интерфейса. Но экспериментальный статус нужно превратить в инженерные условия: проверять критичные поля, записывать наблюдаемую версию, иметь текстовый fallback и отслеживать изменения лимитов. Изображения преобразуются во входные токены; текущий верхний предел после ресайза — 384 токена на изображение, при этом отдельно действуют ограничения файла и запроса.
Что делать с R1, V3.2 и старыми алиасами

R1 и V3.2 сохраняют ценность для истории, исследований и воспроизводимого самостоятельного развёртывания. Однако при запуске V4 DeepSeek перевёл deepseek-chat и deepseek-reasoner в окно прекращения поддержки; временно они соответствовали non-thinking и thinking режимам V4 Flash.
В новом коде яснее использовать текущие явные ID. При миграции зафиксируйте провайдера, base URL, фактическую версию, поддерживаемые поля и результаты теста. Сторонний шлюз может сохранить старый alias или направить его на другой снимок модели.
Проверка, после которой можно остановиться
Возьмите 12–16 реальных задач: обычные, самые трудные, случаи сбоя инструмента и длинный контекст; изображения добавляйте только если они есть в продукте. Для одинаковых prompt, tools и критериев запишите первичную приёмку, токены, кэш, задержку, повторные попытки, ручную правку и стоимость принятого результата.
Остановитесь на Flash, если он проходит все критичные случаи. Направляйте на Pro только тот класс задач, где разница повторяется. Не добавляйте Vision Exp, если изображение можно надёжно исключить из входа. Более подробная интеграция флагмана разобрана в руководстве по DeepSeek V4 Pro API.
Так выбор остаётся проверяемым: минимальная конфигурация, выполняющая критерии, становится базовой, а дополнительная цена и экспериментальный риск появляются только там, где дают наблюдаемый результат.



