NeuralBridgeDocumentation

Qwen 3.7 Max

unofficialchat
DeveloperQwen
Identifierqwen/qwen3.7-max-12544

Qwen 3.7 Max specifications

Context window1M
Max output tokens131072
Release date—
InputText
OutputText

Qwen 3.7 Max pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens186,58 ₽ per 1M tokens
Output tokens1306,03 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What Qwen 3.7 Max can do

Qwen 3.7 Max API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-max-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qwen3.7-max-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.7-max-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Основна ручка чату: приймає історію повідомлень і повертає відповідь моделі. Підтримує потоковий та звичайний режими.
POST /v1/responsesResponses
Альтернативний формат чату зі станом і структурованим виводом.
POST /v1/messagesMessages
Формат Anthropic: той же чат для клієнтів і SDK, написаних під Claude.
POST /v1/converseConverse
Формат Amazon Bedrock Converse — для клієнтів, написаних під нього.
POST /v1/converse-streamConverse Stream
Потоковий варіант формату Bedrock Converse.
POST /v1/generateContentГенерувати контент
Формат Google Gemini — для клієнтів і SDK, написаних під нього.
POST /v1/streamGenerateContentStream Generate Content
Потоковий варіант формату Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Впливає на різноманітність відповіді: чим вище значення, тим випадковіший вивід, чим нижче — тим передбачуваніший.
top_p1—Обмежує вибір часток найймовірніших токенів: враховуються лише ті, чиї ймовірності в сумі дають P.
max_tokens——Верхня межа кількості токенів, які модель може згенерувати у відповіді.
presence_penalty0—Знижує ймовірність токена, якщо він вже зустрічався в тексті — модель охоче переходить до нових тем.
frequency_penalty0—Знижує ймовірність token пропорційно тому, як часто він вже зустрічався — бореться з повтореннями.
stop——Список рядків-обмежувачів: генерація переривається, як тільки модель видає будь-який з них.
seed——Фіксує випадковість: повторний запит з тим же seed і тими ж параметрами дає той самий результат.
response_format——Формат відповіді: звичайний текст або строгий JSON за заданою схемою.
streamfalse—Віддавати відповідь потоком у міру генерації, а не одним куском в кінці.
tools———
reasoning_effort—none, highРівень мислення: скільки зусиль модель витрачає на розмірковування перед відповіддю. Вище рівень — глибший розбір, більше часу і токенів.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά