NeuralBridgeDocumentation

deepseek r1 distill qwen 32b

unofficialchat
DeveloperDeepSeek
Identifierdeepseek/deepseek-r1-distill-qwen-32b-08130

deepseek r1 distill qwen 32b specifications

Context window80K
Max output tokens80000
Release date
InputText
OutputText

deepseek r1 distill qwen 32b pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens64,61per 1M tokens
Output tokens634,53per 1M tokens

Prices are in rubles and may change with exchange rates.

What deepseek r1 distill qwen 32b can do

deepseek r1 distill qwen 32b API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="deepseek/deepseek-r1-distill-qwen-32b-08130",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "deepseek/deepseek-r1-distill-qwen-32b-08130",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-r1-distill-qwen-32b-08130",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Чаттын негизги эндпоинти: билдирүүлөр тарыхын кабыл алып, модельдин жоопту кайтарат. Акыма жана кадимки режимдерди колдойт.
POST /v1/responsesResponses
Чаттын абалы жана түзүлгөн чыгуу менен альтернативдүү формат.
POST /v1/messagesMessages
Anthropic форматы: Claude үчүн жазылган клиенттер жана SDK'лар үчүн ошол эле чат.
POST /v1/converseConverse
Amazon Bedrock Converse форматы — аны колдонуу үчүн жазылган кардарлар үчүн.
POST /v1/converse-streamConverse Stream
Bedrock Converse форматынын агымдык варианты.
POST /v1/generateContentGenerate Content
Google Gemini форматы — клиенттер жана анын үчүн жазылган SDK'тар үчүн.
POST /v1/streamGenerateContentStream Generate Content
Gemini форматынын агымдык варианты.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Жооптун ар түрдүүлүгүнө таасир этет: баалуулук жогору болсо, чыгуу көбүрөөк кездешүүчү, төмөн болсо — алдын ала болжолдуу
top_p1Эң мүмкүн токендердин үлүштөрүн тандоону чектейт: суммасы P болгон гана токендер эске алынат
max_tokensЖоопте модель генерациялай алат токендердин жогорку чеги.
presence_penalty0Эгер токен текстте мурда кездешкен болсо, анын мүмкүнчүлүгүн азайтат — модель жаңы темаларга тезирээк өтөт.
frequency_penalty0Токендин мүмкүнчүлүгүн алгачкы кездешүү санына пропорционал түрдө азайтат — кайталоолорго каршы күрөшөт.
stopТуктатуучу саптар тизмеси: модель алардын бирин чыгарганда генерация токтойт.
seedКачандыкты бекитет: ошол эле seed жана ошол эле параметрлер менен кайталанган суроо ошол эле натыйжаны берет.
response_formatЖооп форматы: кадимки текст же катаал JSON берилип жаткан схемага ылайык.
streamfalseЖоопту генерациялоонун учурунда агым түрүндө берүү, акырында бир бүтүн бөлүк катары эмес.
reasoning_effortlow, medium, highОй жүгүртүү деңгээли: жооп берүүдөн мурун модель канчалык күч арнаганын көрсөтөт. Жогорку деңгээл — тереңирээк талдоо, көбүрөөк убакыт жана токендер.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά