Gemini 3.8 Flash API
1M contextgemini-3-8-flash — текстовая модель-модель от Google.
audio_inputcode_executiondocument_understandingfunction_callingprompt_cachingreasoningstreamingstructured_outputvisionweb_search
Попробуйте прямо здесь
Gemini 3.8 Flash Открыть в песочнице
Что умеет Gemini 3.8 Flash
- Audio Input
- Code Execution
- Анализ документов
- Вызов функций
- Кэширование промпта
- Рассуждения
- Потоковый ответ
- Structured Output
- Анализ изображений
- Поиск в интернете
Стоимость
за 1 млн кэшированных входных токенов
единый
9.9 ₽
за 1 млн входных текстовых токенов
единый
99.04 ₽
за 1 млн выходных текстовых токенов
единый
495 ₽
web search
единый
1.85 ₽
Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.
Технические характеристики
Контекст
1,048,576
токенов
Output
65,536
токенов
Vendor
google
Modality
text
Gemini 3.8 Flash API — быстрая мультимодальная модель Google
Gemini 3.8 Flash — модель Google из США, выпущенная 2 сентября 2026 года. Она объединяет скорость линейки Flash с возможностями для долгих задач программирования, автономных агентов и корпоративных процессов. Модель принимает текст, изображения, аудио, видео и PDF, формирует текстовые ответы, поддерживает контекст до 1 048 576 токенов, function calling, поиск, кэширование и выполнение кода.
Параметры запроса
Параметры, которые принимает модель. Передаются в теле запроса.
ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreqarray
—
—Сообщения в OpenAI-compatible формате.
max_completion_tokensinteger
min: 1 · max: 65536
8192stoparray of strings
—
—seedinteger
—
—reasoning_effortenum
low, medium, high
—Gemini 3.8 Flash не поддерживает none/minimal.
toolsarray
—
—tool_choicestring
—
—response_formatobject
—
—streamboolean
—
falsestream_optionsobject
—
—extra_bodyobject
—
—Gemini-only параметры OpenAI-compatible endpoint.
Пример кода
gemini-3-8-flash_example.py
from openai import OpenAI
client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)
# ── С веб-поиском ──
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[{"role": "user", "content": "Что нового в AI сегодня?"}],
tools=[{"type": "web_search"}],
)
print(resp.choices[0].message.content)Частые вопросы о Gemini 3.8 Flash
Gemini 3.8 Flash — мультимодальная модель Google для работы с текстом, изображениями, видео, аудио и PDF. В Ranvik API она доступна по единому ключу.
Модель подходит для разработки ПО, автономных агентов и сложных рабочих процессов. Контекст до 1 048 576 токенов помогает обрабатывать объемные материалы.
Зарегистрируйтесь в Ranvik API, откройте раздел с ключами и создайте ключ доступа. Его можно подключить к сайту, приложению, боту или серверному коду.
Зарегистрируйтесь в Ranvik API, получите единый ключ и отправляйте запросы через API. Сервис работает в России без VPN и подходит для интеграций.
Да. В Ranvik API доступна оплата в российских рублях, а баланс пополняется перед использованием. Расходы и историю списаний удобно отслеживать в кабинете.
Модель принимает текст, изображения, видео, аудио и PDF, а возвращает текст. Поддерживаются function calling, поиск, кэширование и выполнение кода.