DeepSeek V4.1 Flash API
1M contextdeepseek-flash — текстовая модель-модель от Deepseek.
function_callingjson_modeprompt_cachingreasoningstreamingvision
Попробуйте прямо здесь
DeepSeek V4.1 Flash Открыть в песочнице
Что умеет DeepSeek V4.1 Flash
- Вызов функций
- JSON Mode
- Кэширование промпта
- Рассуждения
- Потоковый ответ
- Анализ изображений
Стоимость
за 1 млн кэшированных входных токенов
peak-safe
2 ₽
за 1 млн входных текстовых токенов
peak-safe
99.75 ₽
за 1 млн выходных текстовых токенов
peak-safe
399 ₽
Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.
Технические характеристики
Контекст
1,000,000
токенов
Output
393,216
токенов
Vendor
deepseek
Modality
text
DeepSeek V4.1 Flash API
DeepSeek V4.1 Flash — модель китайского провайдера DeepSeek, выпущенная 10 сентября 2026 года. Ее особенность — MoE-архитектура Causal-Encoder-Decoder с 552 млрд параметров и асимметричной активацией: 8 млрд на входе и 16 млрд на выходе. Модель поддерживает нативное понимание изображений, ориентирована на быстрый инференс и высокий throughput для приложений, ассистентов и агентных сценариев.
Параметры запроса
Параметры, которые принимает модель. Передаются в теле запроса.
ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreqarray
—
—Сообщения Chat Completions. content принимает текст и image_url (URL или data URL).
max_completion_tokensinteger
min: 1 · max: 393216
8192Лимит ответа: по умолчанию 8K без thinking и 64K с thinking.
thinkingobject
—
—{type:"enabled"|"disabled"}. По умолчанию disabled.
reasoning_effortenum
none, low, high, max
noneИнтенсивность рассуждений. minimal совместимо с low; medium/xhigh — с high.
response_formatobject
—
—JSON mode через {type:"json_object"}.
toolsarray
—
—Function calling.
tool_choice—
—В thinking-режиме required и выбор именованной функции не поддерживаются.
streamboolean
—
falseПотоковый ответ SSE.
Пример кода
deepseek-flash_example.py
from openai import OpenAI
client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
model="deepseek-flash",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)Частые вопросы о DeepSeek V4.1 Flash
DeepSeek V4.1 Flash — языковая MoE-модель DeepSeek с нативным пониманием изображений. Она подходит для текстовых и мультимодальных сценариев через API.
Модель помогает автоматизировать диалоги, анализировать тексты и изображения, писать код и создавать AI-функции в сервисах, сохраняя высокую скорость ответов.
Для подключения API используйте Ranvik API: зарегистрируйтесь в личном кабинете, создайте ключ и интегрируйте его в приложение через единый API-интерфейс.
Подключайтесь через Ranvik API: сервис рассчитан на работу в России без VPN. Получите API-ключ в кабинете и отправляйте запросы из своего приложения.
Ranvik API поддерживает оплату в рублях: баланс можно пополнить банковской картой, через СБП или безналичным платежом для бизнеса и ИП.
Создайте API-ключ в Ranvik API, укажите его в настройках SDK или HTTP-клиента и передавайте промпты в запросах. Такой подход удобен для быстрого запуска.