NeuralBridgeDocumentation

GLM-5.3

unofficialchat
DeveloperZhipu AI
Identifierz-ai/glm-5.3-01402

GLM-5.3 specifications

Context window1M
Max output tokens131072
Release date2026-09-15
InputText
OutputText

GLM-5.3 pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens280 ₽ per 1M tokens
Output tokens880 ₽ per 1M tokens
Cache read56 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What GLM-5.3 can do

GLM-5.3 API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-01402",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "z-ai/glm-5.3-01402",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-5.3-01402",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Chat-ի հիմնական endpoint-ը՝ ընդունում է հաղորդագրությունների պատմությունը և վերադարձնում է model-ի պատասխանը։ Աջակցում է հոսքային և սովորական ռեժիմներին։
POST /v1/responsesResponses
Փոխարինող զրույցի ձևաչափ՝ վիճակով և կառուցվածքային ելքով։
POST /v1/messagesMessages
Anthropic ձևաչափ՝ նույն չատը հաճախորդների և SDK-ների համար, որոնք գրված են Claude-ի համար.
POST /v1/converseConverse
Amazon Bedrock Converse ֆորմատը՝ այն հաճախորդների համար, որոնք գրված են դրա համար։
POST /v1/converse-streamConverse Stream
Bedrock Converse ֆորմատի հոսքային տարբերակը։
POST /v1/generateContentՍտեղծել բովանդակություն
Google Gemini ձևաչափ — հաճախորդների և SDK-ների համար, որոնք գրված են դրա համար.
POST /v1/streamGenerateContentStream Generate Content
Gemini ձևաչափի հոսքային տարբերակ։

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Ազդում է պատասխանի բազմազանության վրա՝ որքան բարձր արժեքը, այնքան ավելի պատահական է ելքը, իսկ որքան ցածր՝ այնքան ավելի կանխատեսելի։
top_p1—Սահմանափակում է ամենաավելի հավանական տոկենների բաժինների ընտրությունը՝ հաշվում են միայն այն, որոնց հավանականությունների գումարը հավասար է P-ին։
max_tokens——Token-ների թվի վերին սահմանը, որոնք model-ը կարող է գեներացնել պատասխանում։
presence_penalty0—Նվազեցնում է token-ի հավանականությունը, եթե այն արդեն հանդիպել է տեքստում՝ model-ը ավելի շուտ անցնում է նոր թեմաներ։
frequency_penalty0—Նվազեցնում է token-ի հավանականությունը համաչափ այն հաճախականությանը, ինչքանից այն արդեն հանդիպել է — պայքարում է կրկնությունների դեմ.
stop——Սահմանափակող տողերի ցանկը՝ գեներացիան դադարեցնում է, երբ մոդելը արտածում է որևէ մեկը։
seed——Ֆիքսում է պատահականությունը՝ նույն seed‑ը և նույն պարամետրերով կրկնակի հարցումը տալիս նույն արդյունքը։
response_format——Պատասխանի ֆորմատը՝ սովորական տեքստ կամ խիստ JSON՝ ըստ սահմանված սխեմայի։
streamfalse—Պատասխանը պետք է ուղարկվի հոսքով գեներացիայի ընթացքում, ոչ թե մեկ կտորով վերջում։
tools———
tool_choice———
parallel_tool_calls———
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά