Текстовая модель · xai

Grok 4.5

grok-4.5

Grok 4.5 — текстовая модель от xai, доступная через единый Ranvik API. Контекстное окно — 500k токенов. Поддерживаемые возможности: code_execution, function_calling, reasoning, streaming, structured_output, vision, web_search.

от 665 ₽ / 1M

Grok 4.5 — флагманская текстовая модель xAI с 500K контекстом, поддержкой изображений, вызовом инструментов, поиском по актуальным данным и настраиваемым reasoning_effort. Хорошо подходит для кода, агентов и задач, где нужен быстрый доступ к свежим данным через инструменты поиска.

Технические характеристики

МодальностьТекстовая модель
Провайдерxai
Контекст500 000 токенов
СтатусАктивна
ID для запросовgrok-4.5

Возможности

Streaming (SSE)— Получение ответа по мере генерации — токен за токеном через Server-Sent Events.

Как работает

Передай stream: true в теле запроса — сервер вернёт SSE-поток с заголовком content-type: text/event-stream. Каждый чанк — строка вида data: {...}\n\n. Конец потока — data: [DONE]\n\n.

curl -N https://api.ranvik.ru/v1/chat/completions \
  -H "Authorization: Bearer rk_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5",
    "messages": [{"role": "user", "content": "Привет"}],
    "stream": true,
    "stream_options": {"include_usage": true}
  }'

Каждый чанк содержит choices[0].delta — частичные данные. Последний чанк перед [DONE] (если включить stream_options.include_usage: true) содержит usage с реальным числом токенов — используй для биллинг-учёта на клиенте.

Когда использовать

  • Чат-интерфейсы, где важна перцептивная скорость отклика.
  • Длинные ответы (> 1000 токенов) — пользователь видит прогресс.
  • Streaming tool-calls — delta.tool_calls[i].function.arguments приходят инкрементально.

Когда НЕ использовать

  • Backend-to-backend интеграции, где нужен только финальный JSON — добавляет парсинг SSE без выгод.
  • Когда обязательно знать стоимость до отправки в БД — без include_usage затраты неизвестны.
Vision (анализ изображений)— Картинки на вход вместе с текстом — OCR, распознавание объектов, описание сцен, анализ графиков.

Как передать изображение

Через массив content в сообщении вместо строки. Поддерживается URL и base64 (data URI).

{
  "model": "gpt-5",
  "messages": [{
    "role": "user",
    "content": [
      {"type": "text", "text": "Что на этой схеме?"},
      {"type": "image_url", "image_url": {"url": "https://.../diagram.png"}}
    ]
  }]
}

Для base64: "url": "data:image/png;base64,iVBOR...". Размер ограничен ~20MB.

Биллинг изображений

Картинка считается как input-токены — точное число зависит от размера и detail. Грубо: 512×512 ≈ 250 токенов, 2048×2048 ≈ 1500. Минимизируй размер если нужно много кадров.

Что НЕ умеют vision-модели

  • Точные измерения (расстояния, размеры в пикселях).
  • Распознавание текста на сложных шрифтах при низком DPI — лучше OCR-модель.
  • Деанонимизация лиц / людей — модели отказываются.
  • Code Execution
  • Function Calling
  • Reasoning
  • Streaming
  • Structured Output
  • Vision
  • Веб-поиск

Цены

ЕдиницаЦена
за 1М input · единый665 ₽
за 1М output · единый1 995 ₽
web_search · единый1.66 ₽
code_interpreter · единый1.66 ₽

Цены указаны в рублях. Списываются с баланса проекта при каждом успешном запросе.

Поддерживаемые параметры

Параметры передаются вендору как есть (pure proxy) — мы не валидируем их у себя на стороне. Если вендор не примет — вернётся его ошибка.

ПараметрТипДиапазон / valuesDefaultОписание
messagesrequiredarray Массив сообщений в OpenAI-совместимом формате. Поддерживается текст и изображения во входном контенте.
max_completion_tokensintegermin: 18192 Лимит токенов ответа. Для Grok 4.5 используйте max_completion_tokens.
temperaturenumbermin: 0 · max: 21 Креативность ответа.
top_pnumbermin: 0 · max: 11 Сэмплирование по ядру вероятности.
nintegermin: 1 · max: 81 Количество вариантов ответа.
reasoning_effortenumlow, medium, highmedium Интенсивность рассуждения Grok 4.5.
response_formatobject Структурированный вывод: json_object или json_schema.
toolsarray Определения функций и инструментов.
tool_choiceobject Выбор инструмента: auto, none, required или конкретная функция.
parallel_tool_callsbooleantrue Разрешить параллельные вызовы инструментов.
search_parametersobject Параметры поиска xAI: режим, источники и настройки поиска по актуальным данным.
deferredbooleanfalse Отложенный async-режим ответа, если доступен для аккаунта.
seedinteger Сид для воспроизводимости, если поддерживается.
streambooleanfalse SSE-стриминг ответа.
userstring Идентификатор конечного пользователя для безопасности и аналитики.

Пример запроса

from openai import OpenAI

client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

# ── С веб-поиском ──
resp = client.responses.create(
    model="grok-4.5",
    input="Что нового в AI сегодня?",
    tools=[{"type": "web_search"}],
)
print(resp.output_text)

# Генерация файла: client.responses.create(model="grok-4.5", input="...", tools=[{"type":"code_interpreter"}])

Замените rk_live_... на ваш ключ из кабинета.