GPT-4o mini API

128k context
ПровайдерOpenai

gpt-4o-mini — текстовая модель-модель от Openai.

function_callingstreamingvision

Попробуйте прямо здесь

Что умеет GPT-4o mini

  • Вызов функций
  • Потоковый ответ
  • Анализ изображений

Стоимость

за 1 млн кэшированных входных токенов
cache_read
1.98 ₽
за 1 млн входных текстовых токенов
19.81 ₽
за 1 млн выходных текстовых токенов
79.23 ₽
web search
1.32 ₽
code interpreter
3.96 ₽

Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.

Технические характеристики

Контекст
128,000
токенов
Output
16,384
токенов
Vendor
openai
Modality
text

GPT-4o mini API: быстрая и экономичная модель OpenAI

GPT-4o mini — компактная модель OpenAI, выпущенная 18 июля 2024 года. Она сочетает низкую задержку и экономичность с обработкой текста и изображений, поддержкой вызова функций и работой с длинным контекстом. Подходит для чат-ботов, автоматизации и приложений с большим числом API-запросов.

Параметры запроса

Параметры, которые принимает модель. Передаются в теле запроса.

ПараметрТипДиапазон / значенияПо умолчаниюОписание
max_completion_tokens
integer
min: 1 · max: 16384
4096
Лимит output. max_tokens deprecated, используйте этот.
temperature
number
min: 0 · max: 2
1
0 — детерминированно, 2 — максимум креативности.
top_p
number
min: 0 · max: 1
1
Nucleus sampling. Альтернатива temperature.
n
integer
min: 1 · max: 10
1
Сколько вариантов сгенерировать.
stop
array
—
—
До 4 строк, на которых остановиться.
frequency_penalty
number
min: -2 · max: 2
0
Штраф за повторение токенов.
presence_penalty
number
min: -2 · max: 2
0
Штраф за уже использованные токены.
response_format
object
—
—
{type:"text"} | {type:"json_object"} | {type:"json_schema",json_schema:{...}}.
seed
integer
—
—
Для воспроизводимости (beta).
logprobs
boolean
—
false
Возвращать log-вероятности.
top_logprobs
integer
min: 0 · max: 20
—
Количество top-N logprobs.
logit_bias
object
—
—
{token_id: bias} — изменение вероятностей.
tools
array
—
—
Function/tool definitions.
tool_choice
object
—
—
none | auto | required | {type:"function",function:{name:"X"}}.
parallel_tool_calls
boolean
—
true
service_tier
enum
auto, default, flex, scale, priority
auto
metadata
object
—
—
До 16 key-value пар для трекинга.
store
boolean
—
false
Сохранять output для distillation/evals.
prompt_cache_key
string
—
—
Ключ оптимизации кэша.
safety_identifier
string
max: 64
—
Stable identifier юзера для safety.
stream
boolean
—
false
messagesreq
array
—
—
Массив сообщений диалога: [{role: "system"|"user"|"assistant"|"developer"|"tool", content: string|array}]. content может быть multimodal — массив частей {type: "text"|"image_url"|"input_audio"|...}.
1 пример
Примеры
[
  {
    "role": "system",
    "content": "You are a helpful assistant."
  },
  {
    "role": "user",
    "content": "Привет!"
  }
]
web_search_options
object
—
—
Конфигурация built-in web search tool. {search_context_size: "low"|"medium"|"high", user_location: {...}}.

Пример кода

gpt-4o-mini_example.py
from openai import OpenAI

client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

# ── С веб-поиском ──
resp = client.responses.create(
    model="gpt-4o-mini",
    input="Что нового в AI сегодня?",
    tools=[{"type": "web_search"}],
)
print(resp.output_text)

# Генерация файла: client.responses.create(model="gpt-4o-mini", input="...", tools=[{"type":"code_interpreter"}])
Полная документация модели

Частые вопросы о GPT-4o mini

GPT-4o mini — компактная модель OpenAI для работы с текстом и изображениями. В Ranvik API ее удобно подключать к сайтам, ботам и внутренним сервисам.
Модель помогает создавать чат-ботов, автоматизировать ответы, обработку текста и вызовы функций. Ranvik API упрощает ее применение в рабочих сценариях.
Подключить API GPT-4o mini можно через Ranvik API. Сервис предоставляет удобный доступ для интеграций, тестирования моделей и запуска AI-функций.
Используйте Ranvik API: сервис позволяет работать с API GPT-4o mini без VPN. Подключите ключ к своему приложению и отправляйте запросы по API.
Да, в Ranvik API доступна оплата в российских рублях. Это делает подключение GPT-4o mini удобнее для проектов с локальными способами расчета.
GPT-4o mini подходит для поддержки клиентов, генерации и анализа текста, работы с изображениями и автоматизации. Ranvik API помогает быстро внедрить модель.