GLM-5.2

1M context
ПровайдерZai

glm-5.2 — текстовая модель-модель от Zai.

function_callingprompt_cachingreasoningstreamingstructured_output

Попробуйте прямо здесь

Что умеет GLM-5.2

  • Function Calling
  • Prompt Caching
  • Reasoning
  • Streaming
  • Structured Output

Стоимость

за 1М cache read
единый
53.2 ₽
за 1М input
единый
266 ₽
за 1М output
единый
848 ₽

Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.

Технические характеристики

Контекст
1,000,000
токенов
Output
128,000
токенов
Vendor
zai
Modality
text

Параметры запроса

Параметры, которые принимает модель. Передаются в теле запроса.

ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreq
array
Сообщения в OpenAI-compatible формате.
max_tokens
integer
min: 1 · max: 128000
8192
temperature
number
min: 0 · max: 2
1
top_p
number
min: 0 · max: 1
1
stop
array of strings
tools
array
OpenAI-compatible function definitions.
tool_choice
string
auto, none, required или выбор функции.
response_format
object
json_object или json_schema.
stream
boolean
false
stream_options
object
Для финального usage используйте include_usage=true.

Пример кода

glm-5.2_example.py
from openai import OpenAI

client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)
Полная документация модели