NeuralBridgeDocumentation

QvQ Max

unofficialchat
DeveloperAlibaba
Identifierqwen/qvq-max-01402

QvQ Max specifications

Context window131K
Max output tokens8192
Release date
InputText, Image
OutputText

QvQ Max pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens216per 1M tokens
Output tokens864per 1M tokens

Prices are in rubles and may change with exchange rates.

What QvQ Max can do

QvQ Max API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qvq-max-01402",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qvq-max-01402",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qvq-max-01402",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Чаттың негізгі хэндлі: хабарламалар тарихын қабылдайды және модельдің жауабын қайтарады. Ағынды және кәдімгі режимдерді қолдайды.
POST /v1/responsesResponses
Күйі мен құрылымдалған шығаруымен альтернативті чат форматы.
POST /v1/messagesХабарламалар
Anthropic форматы: Claude-ға арналған клиенттер мен SDK-лар үшін бірдей чат.
POST /v1/converseConverse
Amazon Bedrock Converse форматы — оны қолдану үшін жазылған клиенттерге.
POST /v1/converse-streamConverse Stream
Bedrock Converse форматының ағынды нұсқасы.
POST /v1/generateContentМазмұнды генерациялау
Google Gemini форматы — клиенттер мен оған арналған SDK-лар үшін.
POST /v1/streamGenerateContentStream Generate Content
Gemini форматындағы ағындық нұсқа.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Жауаптың әртүрлілігіне әсер етеді: мәні жоғары болса, шығару кездейсоқырақ, төмен болса — болжамдырақ.
top_p1Ең ықтимал токендердің үлесін таңдау шектеледі: тек ықтималдығының қосындысы P-ге тең немесе одан аз токендер ескеріледі.
max_tokensЖауапта модель генерациялай алатын токендердің жоғарғы шегі.
presence_penalty0Токеннің ықтималдығын азайтады, егер ол мәтінде бұрын кездессе — модель жаңа тақырыптарға көбірек ауысады.
frequency_penalty0Токеннің ықтималдығын оның қаншалықты жиі кездескеніне пропорционалды түрде азайтады — қайталаулармен күреседі.
stopШектеу жолдарының тізімі: модель кез келген бірін шығарған сәтте генерация тоқтайды.
seedКездейсоқтықты бекітеді: бірдей seed және бірдей параметрлермен қайталанған сұрау бірдей нәтижені береді.
response_formatЖауап форматы: қарапайым мәтін немесе берілген схема бойынша қатаң JSON.
streamfalseЖауапты генерация барысында ағын ретінде беру, соңында бір блок ретінде емес.
tools
tool_choice
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά