Модели DeepSeek V4

Две модели V4. Один адрес. Меняется только название модели.

Большинству задач не нужна модель рассуждений — нужна та, которой достаточно. Понять, какая подходит вам, — это разговор на десять минут, а не проект.

Две модели, разные задачи

У обеих моделей одинаковый контекст и одинаковый предел вывода. Различаются они характером работы и тем, что принимают на входе.

DeepSeek V4.1 Flash

  • Контекст
  • до 1 млн входных токенов
  • Вывод
  • до 384 тыс. токенов
  • Вход
  • текст, изображения, видео
  • Одновременных запросов
  • 2 500

Основная рабочая модель: документы, извлечение данных, классификация, работа с кодом, поддержка пользователей. Принимает изображения и видео напрямую.

DeepSeek V4.1 Pro

  • Контекст
  • до 1 млн входных токенов
  • Вывод
  • до 384 тыс. токенов
  • Вход
  • текст (изображения не принимает)
  • Одновременных запросов
  • 500

Для задач, где нужен более глубокий разбор: сложные многошаговые рассуждения, разбор спорных случаев, работа с длинными цепочками условий. Изображения не принимает.

Как выбирают на практике

Правило простое: начинайте с Flash. Если на ваших задачах качества не хватает — переходите на Pro для тех вызовов, где это заметно, и оставляйте Flash на всём остальном. Название модели — это параметр в запросе, поэтому переключение не требует переписывать код.

  • Внутренние идентификаторы моделей: deepseek-flash и deepseek-v4-pro
  • Обе модели доступны за одним базовым адресом и с одним API-ключом
  • Формат запросов совместим с OpenAI

Про лимиты

Лимит одновременных запросов различается у двух моделей, и это стоит учитывать при планировании нагрузки. Если ваш профиль упирается в лимит, скажите об этом в заявке — обсудим, как разложить нагрузку, прежде чем вы начнёте переделку.

Характеристики моделей определяет поставщик технологии, а не мы. Они могут меняться. Обязательными для нас являются только те значения, которые зафиксированы в договоре.

ДВЕ МОДЕЛИ, ОДИН АДРЕС

Схема процесса: три этапа, соединённые стрелками; средний этап выделен.

Вход

Нагрузка по профилю

большой поток или сложные задачи

DeepSeek V4.1 Flash / V4.1 Pro

Выход

Flash или Pro, тот же адрес

меняется только название модели

  • Flash: изображения и видео
  • Pro: рассуждения, без зрения
  • Оба: 1 млн контекста, 384K вывода
Адрес один и тот же. Уровень — это параметр, а не переезд.Схема профиля нагрузки. Не скриншот.

Не уверены, какая модель нужна?

Опишите задачу — подскажем, с какой начать, и объясним почему.