GPT-5.6
1.1M contextgpt-5.6 — текстовая модель-модель от Openai.
computer_usefile_searchfunction_callingprompt_cachingreasoningstreamingvisionweb_search
Попробуйте прямо здесь
GPT-5.6 Открыть в Playground
Что умеет GPT-5.6
- Computer Use
- File Search
- Function Calling
- Prompt Caching
- Reasoning
- Streaming
- Vision
- Веб-поиск
Стоимость
за 1М cache read
<= 272k
166 ₽
> 272k
333 ₽
за 1М input
<= 272k
1 663 ₽
> 272k
3 325 ₽
за 1М cache write
<= 272k
2 078 ₽
> 272k
4 156 ₽
за 1М output
<= 272k
9 975 ₽
> 272k
14 963 ₽
Цены указаны в рублях и списываются с баланса проекта за успешные запросы. Надбавки (+) суммируются с базовой ставкой.
Технические характеристики
Контекст
1,050,000
токенов
Output
128,000
токенов
Vendor
openai
Modality
text
Параметры запроса
Параметры, которые принимает модель. Передаются в теле запроса.
ПараметрТипДиапазон / значенияПо умолчаниюОписание
messagesreqarray
—
—Массив сообщений диалога в OpenAI-формате. Поле content может быть строкой или мультимодальным массивом с текстом и изображениями.
max_completion_tokensinteger
min: 1 · max: 128000
8192Максимум токенов в ответе, включая токены рассуждения.
reasoning_effortenum
none, low, medium, high, xhigh, max
mediumГлубина рассуждения модели: от none для быстрых ответов до max для самых сложных задач.
verbosityenum
low, medium, high
mediumКонтроль подробности ответа.
temperaturenumber
min: 0 · max: 2
1Креативность ответа: 0 — строже, 2 — разнообразнее.
top_pnumber
min: 0 · max: 1
1Сэмплирование по ядру вероятности. Обычно используйте либо top_p, либо temperature.
stoparray of strings
—
—Стоп-последовательности, на которых генерация должна остановиться.
ninteger
min: 1 · max: 128
1Сколько вариантов ответа сгенерировать.
frequency_penaltynumber
min: -2 · max: 2
0Штраф за повторение токенов.
presence_penaltynumber
min: -2 · max: 2
0Штраф за повторение уже затронутых тем.
response_formatobject
—
—Структурированный вывод: {type:"json_object"} или {type:"json_schema", json_schema:{...}}.
toolsarray
—
—Определения функций и инструментов в OpenAI-формате.
tool_choiceobject
—
—auto | none | required | {type:"function", function:{name:"..."}}.
parallel_tool_callsboolean
—
trueРазрешить параллельные вызовы инструментов.
web_search_optionsobject
—
—Настройки встроенного web search: search_context_size и user_location.
seedinteger
—
—Сид для воспроизводимости, если модель и endpoint его поддерживают.
streamboolean
—
falseSSE-стриминг ответа.
service_tierenum
auto, default, flex, scale, priority
autoУровень обработки OpenAI, если доступен для аккаунта.
storeboolean
—
falseСохранять ответ у провайдера для evals/distillation, если включено.
metadataobject
—
—Метаданные запроса для трекинга.
prompt_cache_keystring
—
—Ключ для повышения вероятности попадания в кэш на похожих промптах.
safety_identifierstring
max: 64
—Стабильный идентификатор пользователя для сигналов безопасности.
Пример кода
gpt-5.6_example.py
from openai import OpenAI
client = OpenAI(api_key="rk_live_...", base_url="https://api.ranvik.ru/v1")
resp = client.chat.completions.create(
model="gpt-5.6",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)
# ── С веб-поиском ──
resp = client.responses.create(
model="gpt-5.6",
input="Что нового в AI сегодня?",
tools=[{"type": "web_search"}],
)
print(resp.output_text)
# Генерация файла: client.responses.create(model="gpt-5.6", input="...", tools=[{"type":"code_interpreter"}])