NeuralBridgeDocumentation

deepseek-v4-pro

unofficialchat
DeveloperDeepSeek
Identifierdeepseek/deepseek-v4-pro-08130

deepseek-v4-pro specifications

Context window1.05M
Max output tokens393216
Release date
InputText
OutputText

deepseek-v4-pro pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens171,6per 1M tokens
Output tokens514,8per 1M tokens
Cache read5,72per 1M tokens

Prices are in rubles and may change with exchange rates.

What deepseek-v4-pro can do

deepseek-v4-pro API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro-08130",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "deepseek/deepseek-v4-pro-08130",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-pro-08130",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Чаттың негізгі хэндлі: хабарламалар тарихын қабылдайды және модельдің жауабын қайтарады. Ағынды және кәдімгі режимдерді қолдайды.
POST /v1/responsesResponses
Күйі мен құрылымдалған шығаруымен альтернативті чат форматы.
POST /v1/messagesХабарламалар
Anthropic форматы: Claude-ға арналған клиенттер мен SDK-лар үшін бірдей чат.
POST /v1/converseConverse
Amazon Bedrock Converse форматы — оны қолдану үшін жазылған клиенттерге.
POST /v1/converse-streamConverse Stream
Bedrock Converse форматының ағынды нұсқасы.
POST /v1/generateContentМазмұнды генерациялау
Google Gemini форматы — клиенттер мен оған арналған SDK-лар үшін.
POST /v1/streamGenerateContentStream Generate Content
Gemini форматындағы ағындық нұсқа.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Жауаптың әртүрлілігіне әсер етеді: мәні жоғары болса, шығару кездейсоқырақ, төмен болса — болжамдырақ.
top_p1Ең ықтимал токендердің үлесін таңдау шектеледі: тек ықтималдығының қосындысы P-ге тең немесе одан аз токендер ескеріледі.
max_tokensЖауапта модель генерациялай алатын токендердің жоғарғы шегі.
presence_penalty0Токеннің ықтималдығын азайтады, егер ол мәтінде бұрын кездессе — модель жаңа тақырыптарға көбірек ауысады.
frequency_penalty0Токеннің ықтималдығын оның қаншалықты жиі кездескеніне пропорционалды түрде азайтады — қайталаулармен күреседі.
stopШектеу жолдарының тізімі: модель кез келген бірін шығарған сәтте генерация тоқтайды.
seedКездейсоқтықты бекітеді: бірдей seed және бірдей параметрлермен қайталанған сұрау бірдей нәтижені береді.
response_formatЖауап форматы: қарапайым мәтін немесе берілген схема бойынша қатаң JSON.
streamfalseЖауапты генерация барысында ағын ретінде беру, соңында бір блок ретінде емес.
reasoning_effortlow, medium, highОйлау деңгейі: жауап бермес бұрын модель қаншалықты күш жұмсап, reasoning жүргізеді. Жоғары деңгей — тереңірек талдау, көбірек уақыт және токендер.
tools
tool_choice
parallel_tool_calls
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά