NeuralBridgeDocumentation

Qwen 3.5 Omni Plus

unofficialchat
DeveloperQwen
Identifierqwen/qwen3.5-omni-plus-12544

Qwen 3.5 Omni Plus specifications

Context window32K
Max output tokens65536
Release date—
InputText, Image
OutputText

Qwen 3.5 Omni Plus pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens35,88 ₽ per 1M tokens
Output tokens251,16 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What Qwen 3.5 Omni Plus can do

Qwen 3.5 Omni Plus API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-omni-plus-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qwen3.5-omni-plus-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.5-omni-plus-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Podstawowy endpoint czatu: przyjmuje historię wiadomości i zwraca odpowiedź modelu. Obsługuje tryby strumieniowy i zwykły.
POST /v1/responsesResponses
Alternatywny format czatu ze stanem i ustrukturyzowanym wyjściem.
POST /v1/messagesMessages
Format Anthropic: ten sam czat dla klientów i SDK, napisanych pod Claude.
POST /v1/converseConverse
Format Amazon Bedrock Converse — dla klientów napisanych pod niego.
POST /v1/converse-streamConverse Stream
Strumieniowa wersja formatu Bedrock Converse.
POST /v1/generateContentGeneruj treść
Format Google Gemini — dla klientów i SDK, napisanych pod niego.
POST /v1/streamGenerateContentStream Generate Content
Strumieniowa wersja formatu Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Wpływa na różnorodność odpowiedzi: im wyższa wartość, tym bardziej losowy wynik, im niższa — tym bardziej przewidywalny.
top_p1—Ogranicza wybór udziałów najbardziej prawdopodobnych tokenów: brane pod uwagę są tylko te, których sumaryczne prawdopodobieństwo daje P.
max_tokens——Górny limit liczby tokenów, które model może wygenerować w odpowiedzi.
presence_penalty0—Obniża prawdopodobieństwo tokena, jeśli już wystąpił w tekście — model chętniej przechodzi do nowych tematów.
frequency_penalty0—Obniża prawdopodobieństwo tokenu proporcjonalnie do tego, jak często już się pojawiał — walczy z powtórzeniami.
stop——Lista ciągów ograniczających: generowanie jest przerywane, gdy model wyemituje którykolwiek z nich.
seed——Ustala losowość: ponowne zapytanie z tym samym seed i tymi samymi parametrami daje ten sam wynik.
response_format——Format odpowiedzi: zwykły tekst lub ścisły JSON według określonego schematu.
streamfalse—Zwracać odpowiedź strumieniem w miarę generowania, a nie jednorazowo na końcu.
tools———
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά