Qwen Max
unofficialchat
Qwen Max specifications
| Context window | 33K |
|---|---|
| Max output tokens | 8192 |
| Release date | — |
| Input | Text |
| Output | Text |
Qwen Max pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 288 ₽ per 1M tokens |
| Output tokens | 1152 ₽ per 1M tokens |
| Cache read | 57,6 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What Qwen Max can do
- Function calling
- feature.ide
- Streaming responses
Qwen Max API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="qwen/qwen-max-01402",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "qwen/qwen-max-01402",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen-max-01402",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Чаттын негизги эндпоинти: билдирүүлөр тарыхын кабыл алып, модельдин жоопту кайтарат. Акыма жана кадимки режимдерди колдойт. |
POST /v1/responses | Responses Чаттын абалы жана түзүлгөн чыгуу менен альтернативдүү формат. |
POST /v1/messages | Messages Anthropic форматы: Claude үчүн жазылган клиенттер жана SDK'лар үчүн ошол эле чат. |
POST /v1/converse | Converse Amazon Bedrock Converse форматы — аны колдонуу үчүн жазылган кардарлар үчүн. |
POST /v1/converse-stream | Converse Stream Bedrock Converse форматынын агымдык варианты. |
POST /v1/generateContent | Generate Content Google Gemini форматы — клиенттер жана анын үчүн жазылган SDK'тар үчүн. |
POST /v1/streamGenerateContent | Stream Generate Content Gemini форматынын агымдык варианты. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Жооптун ар түрдүүлүгүнө таасир этет: баалуулук жогору болсо, чыгуу көбүрөөк кездешүүчү, төмөн болсо — алдын ала болжолдуу |
top_p | 1 | — | Эң мүмкүн токендердин үлүштөрүн тандоону чектейт: суммасы P болгон гана токендер эске алынат |
max_tokens | — | — | Жоопте модель генерациялай алат токендердин жогорку чеги. |
presence_penalty | 0 | — | Эгер токен текстте мурда кездешкен болсо, анын мүмкүнчүлүгүн азайтат — модель жаңы темаларга тезирээк өтөт. |
frequency_penalty | 0 | — | Токендин мүмкүнчүлүгүн алгачкы кездешүү санына пропорционал түрдө азайтат — кайталоолорго каршы күрөшөт. |
stop | — | — | Туктатуучу саптар тизмеси: модель алардын бирин чыгарганда генерация токтойт. |
seed | — | — | Качандыкты бекитет: ошол эле seed жана ошол эле параметрлер менен кайталанган суроо ошол эле натыйжаны берет. |
response_format | — | — | Жооп форматы: кадимки текст же катаал JSON берилип жаткан схемага ылайык. |
stream | false | — | Жоопту генерациялоонун учурунда агым түрүндө берүү, акырында бир бүтүн бөлүк катары эмес. |
tools | — | — | — |
tool_choice | — | — | — |
parallel_tool_calls | — | — | — |