NeuralBridgeDocumentation

glm 4.7 flash

unofficialchat
DeveloperZhipu AI
Identifierz-ai/glm-4.7-flash-08130

glm 4.7 flash specifications

Context window131K
Max output tokens131072
Release date
InputText
OutputText

glm 4.7 flash pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens7,8per 1M tokens
Output tokens52per 1M tokens

Prices are in rubles and may change with exchange rates.

What glm 4.7 flash can do

glm 4.7 flash API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="z-ai/glm-4.7-flash-08130",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "z-ai/glm-4.7-flash-08130",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-4.7-flash-08130",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Чаттың негізгі хэндлі: хабарламалар тарихын қабылдайды және модельдің жауабын қайтарады. Ағынды және кәдімгі режимдерді қолдайды.
POST /v1/responsesResponses
Күйі мен құрылымдалған шығаруымен альтернативті чат форматы.
POST /v1/messagesХабарламалар
Anthropic форматы: Claude-ға арналған клиенттер мен SDK-лар үшін бірдей чат.
POST /v1/converseConverse
Amazon Bedrock Converse форматы — оны қолдану үшін жазылған клиенттерге.
POST /v1/converse-streamConverse Stream
Bedrock Converse форматының ағынды нұсқасы.
POST /v1/generateContentМазмұнды генерациялау
Google Gemini форматы — клиенттер мен оған арналған SDK-лар үшін.
POST /v1/streamGenerateContentStream Generate Content
Gemini форматындағы ағындық нұсқа.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Жауаптың әртүрлілігіне әсер етеді: мәні жоғары болса, шығару кездейсоқырақ, төмен болса — болжамдырақ.
top_p1Ең ықтимал токендердің үлесін таңдау шектеледі: тек ықтималдығының қосындысы P-ге тең немесе одан аз токендер ескеріледі.
max_tokensЖауапта модель генерациялай алатын токендердің жоғарғы шегі.
presence_penalty0Токеннің ықтималдығын азайтады, егер ол мәтінде бұрын кездессе — модель жаңа тақырыптарға көбірек ауысады.
frequency_penalty0Токеннің ықтималдығын оның қаншалықты жиі кездескеніне пропорционалды түрде азайтады — қайталаулармен күреседі.
stopШектеу жолдарының тізімі: модель кез келген бірін шығарған сәтте генерация тоқтайды.
seedКездейсоқтықты бекітеді: бірдей seed және бірдей параметрлермен қайталанған сұрау бірдей нәтижені береді.
response_formatЖауап форматы: қарапайым мәтін немесе берілген схема бойынша қатаң JSON.
streamfalseЖауапты генерация барысында ағын ретінде беру, соңында бір блок ретінде емес.
reasoning_effortlow, medium, highОйлау деңгейі: жауап бермес бұрын модель қаншалықты күш жұмсап, reasoning жүргізеді. Жоғары деңгей — тереңірек талдау, көбірек уақыт және токендер.
tools
tool_choice
parallel_tool_calls
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά