NeuralBridgeDocumentation

Qwen Max

unofficialchat
DeveloperAlibaba
Identifierqwen/qwen-max-01402

Qwen Max specifications

Context window33K
Max output tokens8192
Release date
InputText
OutputText

Qwen Max pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens288per 1M tokens
Output tokens1152per 1M tokens
Cache read57,6per 1M tokens

Prices are in rubles and may change with exchange rates.

What Qwen Max can do

Qwen Max API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qwen-max-01402",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qwen-max-01402",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen-max-01402",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Chat-ի հիմնական endpoint-ը՝ ընդունում է հաղորդագրությունների պատմությունը և վերադարձնում է model-ի պատասխանը։ Աջակցում է հոսքային և սովորական ռեժիմներին։
POST /v1/responsesResponses
Փոխարինող զրույցի ձևաչափ՝ վիճակով և կառուցվածքային ելքով։
POST /v1/messagesMessages
Anthropic ձևաչափ՝ նույն չատը հաճախորդների և SDK-ների համար, որոնք գրված են Claude-ի համար.
POST /v1/converseConverse
Amazon Bedrock Converse ֆորմատը՝ այն հաճախորդների համար, որոնք գրված են դրա համար։
POST /v1/converse-streamConverse Stream
Bedrock Converse ֆորմատի հոսքային տարբերակը։
POST /v1/generateContentՍտեղծել բովանդակություն
Google Gemini ձևաչափ — հաճախորդների և SDK-ների համար, որոնք գրված են դրա համար.
POST /v1/streamGenerateContentStream Generate Content
Gemini ձևաչափի հոսքային տարբերակ։

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Ազդում է պատասխանի բազմազանության վրա՝ որքան բարձր արժեքը, այնքան ավելի պատահական է ելքը, իսկ որքան ցածր՝ այնքան ավելի կանխատեսելի։
top_p1Սահմանափակում է ամենաավելի հավանական տոկենների բաժինների ընտրությունը՝ հաշվում են միայն այն, որոնց հավանականությունների գումարը հավասար է P-ին։
max_tokensToken-ների թվի վերին սահմանը, որոնք model-ը կարող է գեներացնել պատասխանում։
presence_penalty0Նվազեցնում է token-ի հավանականությունը, եթե այն արդեն հանդիպել է տեքստում՝ model-ը ավելի շուտ անցնում է նոր թեմաներ։
frequency_penalty0Նվազեցնում է token-ի հավանականությունը համաչափ այն հաճախականությանը, ինչքանից այն արդեն հանդիպել է — պայքարում է կրկնությունների դեմ.
stopՍահմանափակող տողերի ցանկը՝ գեներացիան դադարեցնում է, երբ մոդելը արտածում է որևէ մեկը։
seedՖիքսում է պատահականությունը՝ նույն seed‑ը և նույն պարամետրերով կրկնակի հարցումը տալիս նույն արդյունքը։
response_formatՊատասխանի ֆորմատը՝ սովորական տեքստ կամ խիստ JSON՝ ըստ սահմանված սխեմայի։
streamfalseՊատասխանը պետք է ուղարկվի հոսքով գեներացիայի ընթացքում, ոչ թե մեկ կտորով վերջում։
tools
tool_choice
parallel_tool_calls
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά