NeuralBridgeDocumentation

Qwen 3.8 Max (0902)

unofficialchat
DeveloperQwen
Identifierqwen/qwen3.8-max-0902-12544

Qwen 3.8 Max (0902) specifications

Context window1M
Max output tokens131072
Release date—
InputText
OutputText

Qwen 3.8 Max (0902) pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens186,58 ₽ per 1M tokens
Output tokens1306,03 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What Qwen 3.8 Max (0902) can do

Qwen 3.8 Max (0902) API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-0902-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qwen3.8-max-0902-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.8-max-0902-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Endpoint principal de chat: primește istoricul mesajelor și returnează răspunsul modelului. Suportă modurile streaming și normal.
POST /v1/responsesResponses
Format alternativ de chat cu stare și ieșire structurată.
POST /v1/messagesMesaje
Format Anthropic: același chat pentru clienți și SDK, scrise pentru Claude.
POST /v1/converseConverse
Formatul Amazon Bedrock Converse — pentru clienții scriși pentru el.
POST /v1/converse-streamConverse Stream
Varianta streaming a formatului Bedrock Converse.
POST /v1/generateContentGenerează conținut
Format Google Gemini — pentru clienți și SDK, scrise pentru el.
POST /v1/streamGenerateContentStream Generate Content
Variantă de flux a formatului Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Influențează diversitatea răspunsului: cu cât valoarea este mai mare, cu atât ieșirea este mai aleatorie, cu cât este mai mică — cu atât este mai predictibilă.
top_p1—Limitează selecția părților celor mai probabile token: se iau în considerare doar cele ale căror probabilități însumate dau P.
max_tokens——Limita superioară a numărului de tokeni pe care modelul îi poate genera în răspuns.
presence_penalty0—Reduce probabilitatea unui token dacă a apărut deja în text – modelul trece mai ușor la subiecte noi.
frequency_penalty0—Reduce probabilitatea tokenului proporțional cu frecvența cu care a apărut deja — combate repetițiile.
stop——Lista de șiruri-limită: generarea se întrerupe de îndată ce modelul emite oricare dintre ele.
seed——Fixează aleatorietatea: o cerere repetată cu același seed și aceiași parametri dă același rezultat.
response_format——Formatul răspunsului: text simplu sau JSON strict conform schemei specificate.
streamfalse—Livrarea răspunsului ca flux pe măsură ce se generează, nu ca un singur bloc la final.
tools———
reasoning_effort—none, highNivelul de gândire: cât de mult efort cheltuie modelul pentru reasoning înainte de răspuns. Un nivel mai înalt – analiză mai profundă, mai mult timp și tokeni.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά