NeuralBridgeDocumentation

glm 4.7 flash

unofficialchat
DeveloperZhipu AI
Identifierz-ai/glm-4.7-flash-08130

glm 4.7 flash specifications

Context window131K
Max output tokens131072
Release date
InputText
OutputText

glm 4.7 flash pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens7,8per 1M tokens
Output tokens52per 1M tokens

Prices are in rubles and may change with exchange rates.

What glm 4.7 flash can do

glm 4.7 flash API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="z-ai/glm-4.7-flash-08130",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "z-ai/glm-4.7-flash-08130",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-4.7-flash-08130",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Ana sohbet uç noktası: mesaj geçmişini alır ve modelin yanıtını döndürür. Akış ve normal modları destekler.
POST /v1/responsesResponses
Durum ve yapılandırılmış çıktı ile alternatif sohbet formatı.
POST /v1/messagesMessages
Anthropic formatı: Claude için yazılmış istemciler ve SDK'lar için aynı sohbet.
POST /v1/converseConverse
Amazon Bedrock Converse formatı — ona göre yazılmış istemciler için.
POST /v1/converse-streamConverse Stream
Bedrock Converse formatının akış versiyonu.
POST /v1/generateContentİçerik Oluştur
Google Gemini formatı — onun için yazılmış istemciler ve SDK'lar için.
POST /v1/streamGenerateContentStream Generate Content
Gemini formatının akış sürümü.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Cevabın çeşitliliğini etkiler: değer ne kadar yüksekse çıktı o kadar rastgele, düşükse o kadar öngörülebilir.
top_p1En olası token paylarının seçimlerini sınırlar: yalnızca olasılıkları toplamı P olanlar dikkate alınır.
max_tokensModelin cevapta üretebileceği token sayısının üst sınırı.
presence_penalty0Metinde zaten görülmüşse token olasılığını azaltır — model yeni konulara daha istekli geçer.
frequency_penalty0Token olasılığını, tokenin daha önce ne kadar sık göründüğüne orantılı olarak azaltır — tekrarları önler.
stopDurdurma satırları listesi: model herhangi birini ürettiği anda üretim durur.
seedRastgeleliği sabitler: aynı seed ve aynı parametrelerle yapılan tekrar isteği aynı sonucu verir.
response_formatYanıt formatı: normal metin veya belirli şemaya göre katı JSON.
streamfalseYanıtı, üretim sırasında bir akış olarak gönder, sonunda tek bir parça olarak değil.
reasoning_effortlow, medium, highDüşünme seviyesi: modelin cevap vermeden önce reasoning için ne kadar çaba harcadığı. Daha yüksek seviye — daha derin analiz, daha fazla zaman ve token.
tools
tool_choice
parallel_tool_calls
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά