Grok 4.20 API

2M context
ПровайдерXai

grok-4.20-non-reasoning — текстовая модель-модель от Xai.

function_callingprompt_cachingstreamingvision

Попробуйте прямо здесь

Что умеет Grok 4.20

  • Вызов функций
  • Кэширование промпта
  • Потоковый ответ
  • Анализ изображений

Стоимость

за 1 млн входных текстовых токенов
165 ₽
за 1 млн выходных текстовых токенов
330 ₽
web search
0.66 ₽
code interpreter
0.66 ₽

Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.

Технические характеристики

Контекст
2,000,000
токенов
Output
64,000
токенов
Vendor
xai
Modality
text

Grok 4.20 API для сложных агентных задач

Grok 4.20 — флагманская модель xAI из США, выпущенная 14 апреля 2026 года. Ее сильная сторона — высокая скорость инференса и надежные агентные вызовы инструментов для комплексных задач. Модель подходит для сценариев, где важны рассуждения, последовательная обработка запросов и интеграция с внешними инструментами через API.

Параметры запроса

Параметры, которые принимает модель. Передаются в теле запроса.

ПараметрТипДиапазон / значенияПо умолчаниюОписание
max_completion_tokens
integer
min: 1 · max: 256000
8192
grok-4 принимает только max_completion_tokens.
temperature
number
min: 0 · max: 2
1
top_p
number
min: 0 · max: 1
1
n
integer
min: 1 · max: 8
1
reasoning_effort
enum
low, high
—
Только для grok-4.20-reasoning. low — быстро, high — глубокое.
response_format
object
—
—
tools
array
—
—
tool_choice
object
—
—
parallel_tool_calls
boolean
—
true
seed
integer
—
—
logprobs
boolean
—
false
top_logprobs
integer
min: 0 · max: 8
—
search_parameters
object
—
—
Live search: {mode:"on/off/auto", sources, ...}.
deferred
boolean
—
false
user
string
—
—
stream
boolean
—
false
messagesreq
array
—
—
Массив сообщений диалога OpenAI-compatible: [{role, content}]. Поддержка multimodal — image_url в content для vision-моделей.
1 пример
Примеры
[
  {
    "role": "system",
    "content": "You are a helpful assistant."
  },
  {
    "role": "user",
    "content": "Привет!"
  }
]
frequency_penalty
number
min: -2 · max: 2
0
Penalty за повторение токенов (-2..2).
presence_penalty
number
min: -2 · max: 2
0
Penalty за повторение тем (-2..2).
stop
array of strings
—
—
До 4 stop-последовательностей.
logit_bias
object
—
—
Map token_id → bias (-100..100).

Пример кода

grok-4.20-non-reasoning_example.py
from openai import OpenAI

client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
    model="grok-4.20-non-reasoning",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

# ── С веб-поиском ──
resp = client.responses.create(
    model="grok-4.20-non-reasoning",
    input="Что нового в AI сегодня?",
    tools=[{"type": "web_search"}],
)
print(resp.output_text)

# Генерация файла: client.responses.create(model="grok-4.20-non-reasoning", input="...", tools=[{"type":"code_interpreter"}])
Полная документация модели

Частые вопросы о Grok 4.20

Grok 4.20 — флагманская модель xAI для сложных запросов. Она сочетает высокую скорость инференса, рассуждения и надежные агентные вызовы инструментов.
Grok 4.20 нужна для создания AI-функций в сервисах и продуктах: обработки сложных запросов, автоматизации сценариев и работы с инструментами через API.
Подключить API Grok 4.20 можно через Ranvik API. Сервис помогает быстро начать работу с моделью и использовать единый удобный доступ для интеграций.
Зарегистрируйтесь в Ranvik API, получите ключ и подключите его к своему приложению. Сервис позволяет работать с API Grok 4.20 в России без VPN.
Да, через Ranvik API можно оплачивать доступ к Grok 4.20 в российских рублях. Это упрощает подключение модели для российских команд и разработчиков.
API Grok 4.20 подходит для решений, которым нужны быстрые ответы, многошаговая обработка задач и агентное взаимодействие с подключенными инструментами.