DeepSeek V4.1 Flash API

1M context
ПровайдерDeepseek

deepseek-flash — текстовая модель-модель от Deepseek.

function_callingjson_modeprompt_cachingreasoningstreamingvision

Попробуйте прямо здесь

Что умеет DeepSeek V4.1 Flash

  • Вызов функций
  • JSON Mode
  • Кэширование промпта
  • Рассуждения
  • Потоковый ответ
  • Анализ изображений

Стоимость

за 1 млн кэшированных входных токенов
peak-safe
2 ₽
за 1 млн входных текстовых токенов
peak-safe
99.75 ₽
за 1 млн выходных текстовых токенов
peak-safe
399 ₽

Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.

Технические характеристики

Контекст
1,000,000
токенов
Output
393,216
токенов
Vendor
deepseek
Modality
text

DeepSeek V4.1 Flash API

DeepSeek V4.1 Flash — модель китайского провайдера DeepSeek, выпущенная 10 сентября 2026 года. Ее особенность — MoE-архитектура Causal-Encoder-Decoder с 552 млрд параметров и асимметричной активацией: 8 млрд на входе и 16 млрд на выходе. Модель поддерживает нативное понимание изображений, ориентирована на быстрый инференс и высокий throughput для приложений, ассистентов и агентных сценариев.

Параметры запроса

Параметры, которые принимает модель. Передаются в теле запроса.

ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreq
array
Сообщения Chat Completions. content принимает текст и image_url (URL или data URL).
max_completion_tokens
integer
min: 1 · max: 393216
8192
Лимит ответа: по умолчанию 8K без thinking и 64K с thinking.
thinking
object
{type:"enabled"|"disabled"}. По умолчанию disabled.
reasoning_effort
enum
none, low, high, max
none
Интенсивность рассуждений. minimal совместимо с low; medium/xhigh — с high.
response_format
object
JSON mode через {type:"json_object"}.
tools
array
Function calling.
tool_choice
В thinking-режиме required и выбор именованной функции не поддерживаются.
stream
boolean
false
Потоковый ответ SSE.

Пример кода

deepseek-flash_example.py
from openai import OpenAI

client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
    model="deepseek-flash",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)
Полная документация модели

Частые вопросы о DeepSeek V4.1 Flash

DeepSeek V4.1 Flash — языковая MoE-модель DeepSeek с нативным пониманием изображений. Она подходит для текстовых и мультимодальных сценариев через API.
Модель помогает автоматизировать диалоги, анализировать тексты и изображения, писать код и создавать AI-функции в сервисах, сохраняя высокую скорость ответов.
Для подключения API используйте Ranvik API: зарегистрируйтесь в личном кабинете, создайте ключ и интегрируйте его в приложение через единый API-интерфейс.
Подключайтесь через Ranvik API: сервис рассчитан на работу в России без VPN. Получите API-ключ в кабинете и отправляйте запросы из своего приложения.
Ranvik API поддерживает оплату в рублях: баланс можно пополнить банковской картой, через СБП или безналичным платежом для бизнеса и ИП.
Создайте API-ключ в Ranvik API, укажите его в настройках SDK или HTTP-клиента и передавайте промпты в запросах. Такой подход удобен для быстрого запуска.