NeuralBridgeDocumentation

DeepSeek V4 Flash

unofficialchat
DeveloperDeepSeek
Identifierdeepseek/deepseek-v4-flash-12544

DeepSeek V4 Flash specifications

Context window1M
Max output tokens—
Release date—
InputText
OutputText

DeepSeek V4 Flash pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens14,35 ₽ per 1M tokens
Output tokens100,46 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What DeepSeek V4 Flash can do

DeepSeek V4 Flash API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "deepseek/deepseek-v4-flash-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-flash-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Ana sohbet uç noktası: mesaj geçmişini alır ve modelin yanıtını döndürür. Akış ve normal modları destekler.
POST /v1/responsesResponses
Durum ve yapılandırılmış çıktı ile alternatif sohbet formatı.
POST /v1/messagesMessages
Anthropic formatı: Claude için yazılmış istemciler ve SDK'lar için aynı sohbet.
POST /v1/converseConverse
Amazon Bedrock Converse formatı — ona göre yazılmış istemciler için.
POST /v1/converse-streamConverse Stream
Bedrock Converse formatının akış versiyonu.
POST /v1/generateContentİçerik Oluştur
Google Gemini formatı — onun için yazılmış istemciler ve SDK'lar için.
POST /v1/streamGenerateContentStream Generate Content
Gemini formatının akış sürümü.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Cevabın çeşitliliğini etkiler: değer ne kadar yüksekse çıktı o kadar rastgele, düşükse o kadar öngörülebilir.
top_p1—En olası token paylarının seçimlerini sınırlar: yalnızca olasılıkları toplamı P olanlar dikkate alınır.
max_tokens——Modelin cevapta üretebileceği token sayısının üst sınırı.
presence_penalty0—Metinde zaten görülmüşse token olasılığını azaltır — model yeni konulara daha istekli geçer.
frequency_penalty0—Token olasılığını, tokenin daha önce ne kadar sık göründüğüne orantılı olarak azaltır — tekrarları önler.
stop——Durdurma satırları listesi: model herhangi birini ürettiği anda üretim durur.
seed——Rastgeleliği sabitler: aynı seed ve aynı parametrelerle yapılan tekrar isteği aynı sonucu verir.
response_format——Yanıt formatı: normal metin veya belirli şemaya göre katı JSON.
streamfalse—Yanıtı, üretim sırasında bir akış olarak gönder, sonunda tek bir parça olarak değil.
tools———
reasoning_effort—none, highDüşünme seviyesi: modelin cevap vermeden önce reasoning için ne kadar çaba harcadığı. Daha yüksek seviye — daha derin analiz, daha fazla zaman ve token.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά