Две модели V4. Один адрес. Меняется только название модели.
Большинству задач не нужна модель рассуждений — нужна та, которой достаточно. Понять, какая подходит вам, — это разговор на десять минут, а не проект.
Две модели, разные задачи
У обеих моделей одинаковый контекст и одинаковый предел вывода. Различаются они характером работы и тем, что принимают на входе.
DeepSeek V4.1 Flash
Основная рабочая модель: документы, извлечение данных, классификация, работа с кодом, поддержка пользователей. Принимает изображения и видео напрямую.
DeepSeek V4.1 Pro
Для задач, где нужен более глубокий разбор: сложные многошаговые рассуждения, разбор спорных случаев, работа с длинными цепочками условий. Изображения не принимает.
Как выбирают на практике
Правило простое: начинайте с Flash. Если на ваших задачах качества не хватает — переходите на Pro для тех вызовов, где это заметно, и оставляйте Flash на всём остальном. Название модели — это параметр в запросе, поэтому переключение не требует переписывать код.
-
Внутренние идентификаторы моделей:
deepseek-flashиdeepseek-v4-pro - Обе модели доступны за одним базовым адресом и с одним API-ключом
- Формат запросов совместим с OpenAI
Про лимиты
Лимит одновременных запросов различается у двух моделей, и это стоит учитывать при планировании нагрузки. Если ваш профиль упирается в лимит, скажите об этом в заявке — обсудим, как разложить нагрузку, прежде чем вы начнёте переделку.
Характеристики моделей определяет поставщик технологии, а не мы. Они могут меняться. Обязательными для нас являются только те значения, которые зафиксированы в договоре.
ДВЕ МОДЕЛИ, ОДИН АДРЕС
Вход
Нагрузка по профилю
большой поток или сложные задачи
DeepSeek V4.1 Flash / V4.1 Pro
Выход
Flash или Pro, тот же адрес
меняется только название модели
- Flash: изображения и видео
- Pro: рассуждения, без зрения
- Оба: 1 млн контекста, 384K вывода
Не уверены, какая модель нужна?
Опишите задачу — подскажем, с какой начать, и объясним почему.