NeuralBridgeDocumentation

Qwen 3.8 Max

unofficialchat
DeveloperQwen
Identifierqwen/qwen3.8-max-12544

Qwen 3.8 Max specifications

Context window1M
Max output tokens131072
Release date—
InputText
OutputText

Qwen 3.8 Max pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens186,58 ₽ per 1M tokens
Output tokens1306,03 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What Qwen 3.8 Max can do

Qwen 3.8 Max API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qwen3.8-max-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.8-max-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Чаттын негизги эндпоинти: билдирүүлөр тарыхын кабыл алып, модельдин жоопту кайтарат. Акыма жана кадимки режимдерди колдойт.
POST /v1/responsesResponses
Чаттын абалы жана түзүлгөн чыгуу менен альтернативдүү формат.
POST /v1/messagesMessages
Anthropic форматы: Claude үчүн жазылган клиенттер жана SDK'лар үчүн ошол эле чат.
POST /v1/converseConverse
Amazon Bedrock Converse форматы — аны колдонуу үчүн жазылган кардарлар үчүн.
POST /v1/converse-streamConverse Stream
Bedrock Converse форматынын агымдык варианты.
POST /v1/generateContentGenerate Content
Google Gemini форматы — клиенттер жана анын үчүн жазылган SDK'тар үчүн.
POST /v1/streamGenerateContentStream Generate Content
Gemini форматынын агымдык варианты.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Жооптун ар түрдүүлүгүнө таасир этет: баалуулук жогору болсо, чыгуу көбүрөөк кездешүүчү, төмөн болсо — алдын ала болжолдуу
top_p1—Эң мүмкүн токендердин үлүштөрүн тандоону чектейт: суммасы P болгон гана токендер эске алынат
max_tokens——Жоопте модель генерациялай алат токендердин жогорку чеги.
presence_penalty0—Эгер токен текстте мурда кездешкен болсо, анын мүмкүнчүлүгүн азайтат — модель жаңы темаларга тезирээк өтөт.
frequency_penalty0—Токендин мүмкүнчүлүгүн алгачкы кездешүү санына пропорционал түрдө азайтат — кайталоолорго каршы күрөшөт.
stop——Туктатуучу саптар тизмеси: модель алардын бирин чыгарганда генерация токтойт.
seed——Качандыкты бекитет: ошол эле seed жана ошол эле параметрлер менен кайталанган суроо ошол эле натыйжаны берет.
response_format——Жооп форматы: кадимки текст же катаал JSON берилип жаткан схемага ылайык.
streamfalse—Жоопту генерациялоонун учурунда агым түрүндө берүү, акырында бир бүтүн бөлүк катары эмес.
tools———
reasoning_effort—none, highОй жүгүртүү деңгээли: жооп берүүдөн мурун модель канчалык күч арнаганын көрсөтөт. Жогорку деңгээл — тереңирээк талдоо, көбүрөөк убакыт жана токендер.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά