NeuralBridgeDocumentation

GLM 5.2 Fast Preview

unofficialchat
DeveloperZ-AI
Identifierz-ai/glm-5.2-fast-preview-12544

GLM 5.2 Fast Preview specifications

Context window1M
Max output tokens131072
Release date—
InputText
OutputText

GLM 5.2 Fast Preview pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens136,34 ₽ per 1M tokens
Output tokens954,41 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What GLM 5.2 Fast Preview can do

GLM 5.2 Fast Preview API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="z-ai/glm-5.2-fast-preview-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "z-ai/glm-5.2-fast-preview-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-5.2-fast-preview-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Ana sohbet uç noktası: mesaj geçmişini alır ve modelin yanıtını döndürür. Akış ve normal modları destekler.
POST /v1/responsesResponses
Durum ve yapılandırılmış çıktı ile alternatif sohbet formatı.
POST /v1/messagesMessages
Anthropic formatı: Claude için yazılmış istemciler ve SDK'lar için aynı sohbet.
POST /v1/converseConverse
Amazon Bedrock Converse formatı — ona göre yazılmış istemciler için.
POST /v1/converse-streamConverse Stream
Bedrock Converse formatının akış versiyonu.
POST /v1/generateContentİçerik Oluştur
Google Gemini formatı — onun için yazılmış istemciler ve SDK'lar için.
POST /v1/streamGenerateContentStream Generate Content
Gemini formatının akış sürümü.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Cevabın çeşitliliğini etkiler: değer ne kadar yüksekse çıktı o kadar rastgele, düşükse o kadar öngörülebilir.
top_p1—En olası token paylarının seçimlerini sınırlar: yalnızca olasılıkları toplamı P olanlar dikkate alınır.
max_tokens——Modelin cevapta üretebileceği token sayısının üst sınırı.
presence_penalty0—Metinde zaten görülmüşse token olasılığını azaltır — model yeni konulara daha istekli geçer.
frequency_penalty0—Token olasılığını, tokenin daha önce ne kadar sık göründüğüne orantılı olarak azaltır — tekrarları önler.
stop——Durdurma satırları listesi: model herhangi birini ürettiği anda üretim durur.
seed——Rastgeleliği sabitler: aynı seed ve aynı parametrelerle yapılan tekrar isteği aynı sonucu verir.
response_format——Yanıt formatı: normal metin veya belirli şemaya göre katı JSON.
streamfalse—Yanıtı, üretim sırasında bir akış olarak gönder, sonunda tek bir parça olarak değil.
tools———
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά