NeuralBridgeDocumentation

Qwen 3.8 Omni Flash

unofficialchat
DeveloperQwen
Identifierqwen/qwen3.8-omni-flash-12544

Qwen 3.8 Omni Flash specifications

Context window64K
Max output tokens131072
Release date—
InputText, Image
OutputText

Qwen 3.8 Omni Flash pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens14,35 ₽ per 1M tokens
Output tokens100,46 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What Qwen 3.8 Omni Flash can do

Qwen 3.8 Omni Flash API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-omni-flash-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen/qwen3.8-omni-flash-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.8-omni-flash-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Асосии эндпоинти чат: таърихчаи паёмҳоро қабул мекунад ва ҷавоби моделро бармегардонад. Дастгирии режимҳои ҷараёнӣ ва оддӣ.
POST /v1/responsesResponses
Формати альтернативии чат бо ҳолат ва баровардани сохташуда.
POST /v1/messagesПаёмҳо
Формати Anthropic: чат барои мизоҷон ва SDK-ҳо, ки барои Claude навишта шудаанд.
POST /v1/converseConverse
Формати Amazon Bedrock Converse — барои мизоҷоне, ки барои он навишта шудаанд.
POST /v1/converse-streamConverse Stream
Варианти ҷараёнӣ формати Bedrock Converse.
POST /v1/generateContentЭҷод кардани мундариҷа
Формати Google Gemini — барои мизоҷон ва SDK-ҳо, ки барои он навишта шудаанд.
POST /v1/streamGenerateContentStream Generate Content
Варианти ҷараёни формати Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Таъсир мекунад ба гуногунии ҷавоб: ҳарчанд арзиш баландтар бошад, натиҷа тасодуфӣтар, ҳарчанд пасттар — пешгӯииш бештар.
top_p1—Интихоби саҳмҳои токенҳои эҳтимолии баландтаринро маҳдуд мекунад: танҳо онҳое, ки эҳтимолияти онҳо дар ҷамъбаст P медиҳанд, ҳисобида мешаванд.
max_tokens——Ҳадди болоии шумораи токенҳо, ки модел метавонад дар ҷавоб эҷод кунад.
presence_penalty0—Эҳтимоли токенро кам мекунад, агар он аллакай дар матн пайдо шуда бошад — модел бо шавқ бештар ба мавзӯъҳои нав мегузарад.
frequency_penalty0—Эҳтимолияти токена пропорционально ончанд бартараф шудааст — бо такрорҳо мубориза мебарад.
stop——Рӯйхати сатрҳои маҳдудкунанда: генерация қатъ мешавад, вақте ки модель ягон аз онҳо баромад мекунад.
seed——Случайностро фикси мекунад: дархости такрорӣ бо seed ва параметрҳои якхела натиҷаи якхела медиҳад.
response_format——Формати ҷавоб: матни оддӣ ё JSON-и сахт мувофиқи схемаи муайяншуда.
streamfalse—Ҷавобро ҳамчун поток ҳангоми генерации фиристод, на ҳамчун як қисм дар охир.
tools———
reasoning_effort—none, highСатҳи фикр: чанд кӯшиш модел барои рассуждение пеш аз ҷавоб сарф мекунад. Сатҳи баландтар — таҳлили амиқтар, вақти бештар ва токенҳои бештар.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά