GLM-5.2
1M contextglm-5.2 — текстовая модель-модель от Zai.
function_callingprompt_cachingreasoningstreamingstructured_output
Попробуйте прямо здесь
GLM-5.2 Открыть в Playground
Что умеет GLM-5.2
- Function Calling
- Prompt Caching
- Reasoning
- Streaming
- Structured Output
Стоимость
за 1М cache read
единый
53.2 ₽
за 1М input
единый
266 ₽
за 1М output
единый
848 ₽
Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.
Технические характеристики
Контекст
1,000,000
токенов
Output
128,000
токенов
Vendor
zai
Modality
text
Параметры запроса
Параметры, которые принимает модель. Передаются в теле запроса.
ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreqarray
—
—Сообщения в OpenAI-compatible формате.
max_tokensinteger
min: 1 · max: 128000
8192temperaturenumber
min: 0 · max: 2
1top_pnumber
min: 0 · max: 1
1stoparray of strings
—
—toolsarray
—
—OpenAI-compatible function definitions.
tool_choicestring
—
—auto, none, required или выбор функции.
response_formatobject
—
—json_object или json_schema.
streamboolean
—
falsestream_optionsobject
—
—Для финального usage используйте include_usage=true.
Пример кода
glm-5.2_example.py
from openai import OpenAI
client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)