NeuralBridgeDocumentation

deepseek r1 distill qwen 32b

unofficialchat
DeveloperDeepSeek
Identifierdeepseek/deepseek-r1-distill-qwen-32b-08130

deepseek r1 distill qwen 32b specifications

Context window80K
Max output tokens80000
Release date
InputText
OutputText

deepseek r1 distill qwen 32b pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens64,61per 1M tokens
Output tokens634,53per 1M tokens

Prices are in rubles and may change with exchange rates.

What deepseek r1 distill qwen 32b can do

deepseek r1 distill qwen 32b API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="deepseek/deepseek-r1-distill-qwen-32b-08130",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "deepseek/deepseek-r1-distill-qwen-32b-08130",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-r1-distill-qwen-32b-08130",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Hoofd‑chat‑endpoint: accepteert berichtgeschiedenis en retourneert modelantwoord. Ondersteunt streaming‑ en normale modi.
POST /v1/responsesResponses
Alternatief chatformaat met status en gestructureerde output.
POST /v1/messagesBerichten
Anthropic-formaat: dezelfde chat voor klanten en SDK's die voor Claude geschreven zijn.
POST /v1/converseConverse
Amazon Bedrock Converse‑formaat — voor clients die er voor zijn geschreven.
POST /v1/converse-streamConverse Stream
Streaming‑variant van het Bedrock Converse‑formaat.
POST /v1/generateContentGenereer inhoud
Google Gemini-formaat — voor klanten en SDK's die er voor geschreven zijn.
POST /v1/streamGenerateContentStream Generate Content
Streamvariant van het Gemini-formaat.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Beïnvloedt de diversiteit van het antwoord: hoe hoger de waarde, hoe willekeuriger de output, hoe lager — hoe voorspelbaarder.
top_p1Beperkt de selectie van de meest waarschijnlijke tokens: alleen die waarvan de cumulatieve waarschijnlijkheid P bereikt, worden meegenomen.
max_tokensBovengrens van het aantal tokens dat het model kan genereren in het antwoord.
presence_penalty0Vermindert de kans op een token als deze al in de tekst is voorgekomen — het model schakelt sneller over naar nieuwe onderwerpen.
frequency_penalty0Vermindert de token‑kans evenredig aan hoe vaak deze al is voorgekomen — bestrijdt herhalingen.
stopLijst van delimiter strings: de generatie wordt onderbroken zodra het model een van hen uitstuurt.
seedFixeert de willekeur: een herhaald verzoek met dezelfde seed en dezelfde parameters geeft hetzelfde resultaat.
response_formatAntwoordformaat: gewone tekst of strikte JSON volgens een opgegeven schema.
streamfalseAntwoord streamen tijdens generatie in plaats van in één stuk aan het einde.
reasoning_effortlow, medium, highDenkniveau: hoeveel inspanning het model besteedt aan reasoning vóór het antwoord. Een hoger niveau — diepere analyse, meer tijd en tokens.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά