Gemini 3.8 Flash API

1M context
ПровайдерGoogle

gemini-3-8-flash — текстовая модель-модель от Google.

audio_inputcode_executiondocument_understandingfunction_callingprompt_cachingreasoningstreamingstructured_outputvisionweb_search

Попробуйте прямо здесь

Что умеет Gemini 3.8 Flash

  • Audio Input
  • Code Execution
  • Анализ документов
  • Вызов функций
  • Кэширование промпта
  • Рассуждения
  • Потоковый ответ
  • Structured Output
  • Анализ изображений
  • Поиск в интернете

Стоимость

за 1 млн кэшированных входных токенов
единый
9.9 ₽
за 1 млн входных текстовых токенов
единый
99.04 ₽
за 1 млн выходных текстовых токенов
единый
495 ₽
web search
единый
1.85 ₽

Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.

Технические характеристики

Контекст
1,048,576
токенов
Output
65,536
токенов
Vendor
google
Modality
text

Gemini 3.8 Flash API — быстрая мультимодальная модель Google

Gemini 3.8 Flash — модель Google из США, выпущенная 2 сентября 2026 года. Она объединяет скорость линейки Flash с возможностями для долгих задач программирования, автономных агентов и корпоративных процессов. Модель принимает текст, изображения, аудио, видео и PDF, формирует текстовые ответы, поддерживает контекст до 1 048 576 токенов, function calling, поиск, кэширование и выполнение кода.

Параметры запроса

Параметры, которые принимает модель. Передаются в теле запроса.

ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreq
array
Сообщения в OpenAI-compatible формате.
max_completion_tokens
integer
min: 1 · max: 65536
8192
stop
array of strings
seed
integer
reasoning_effort
enum
low, medium, high
Gemini 3.8 Flash не поддерживает none/minimal.
tools
array
tool_choice
string
response_format
object
stream
boolean
false
stream_options
object
extra_body
object
Gemini-only параметры OpenAI-compatible endpoint.

Пример кода

gemini-3-8-flash_example.py
from openai import OpenAI

client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

# ── С веб-поиском ──
resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[{"role": "user", "content": "Что нового в AI сегодня?"}],
    tools=[{"type": "web_search"}],
)
print(resp.choices[0].message.content)
Полная документация модели

Частые вопросы о Gemini 3.8 Flash

Gemini 3.8 Flash — мультимодальная модель Google для работы с текстом, изображениями, видео, аудио и PDF. В Ranvik API она доступна по единому ключу.
Модель подходит для разработки ПО, автономных агентов и сложных рабочих процессов. Контекст до 1 048 576 токенов помогает обрабатывать объемные материалы.
Зарегистрируйтесь в Ranvik API, откройте раздел с ключами и создайте ключ доступа. Его можно подключить к сайту, приложению, боту или серверному коду.
Зарегистрируйтесь в Ranvik API, получите единый ключ и отправляйте запросы через API. Сервис работает в России без VPN и подходит для интеграций.
Да. В Ranvik API доступна оплата в российских рублях, а баланс пополняется перед использованием. Расходы и историю списаний удобно отслеживать в кабинете.
Модель принимает текст, изображения, видео, аудио и PDF, а возвращает текст. Поддерживаются function calling, поиск, кэширование и выполнение кода.