Nemotron 3.5 Content Safety
unofficialchat
Nemotron 3.5 Content Safety specifications
| Context window | 16K |
|---|---|
| Max output tokens | 4096 |
| Release date | — |
| Input | Text, Image |
| Output | Text |
Nemotron 3.5 Content Safety pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 5,47 ₽ per 1M tokens |
| Output tokens | 10,95 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What Nemotron 3.5 Content Safety can do
- Image understanding
- Streaming responses
Nemotron 3.5 Content Safety API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="nvidia/nemotron-3.5-content-safety-10238",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "nvidia/nemotron-3.5-content-safety-10238",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/nemotron-3.5-content-safety-10238",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Podstawowy endpoint czatu: przyjmuje historię wiadomości i zwraca odpowiedź modelu. Obsługuje tryby strumieniowy i zwykły. |
POST /v1/responses | Responses Alternatywny format czatu ze stanem i ustrukturyzowanym wyjściem. |
POST /v1/messages | Messages Format Anthropic: ten sam czat dla klientów i SDK, napisanych pod Claude. |
POST /v1/converse | Converse Format Amazon Bedrock Converse — dla klientów napisanych pod niego. |
POST /v1/converse-stream | Converse Stream Strumieniowa wersja formatu Bedrock Converse. |
POST /v1/generateContent | Generuj treść Format Google Gemini — dla klientów i SDK, napisanych pod niego. |
POST /v1/streamGenerateContent | Stream Generate Content Strumieniowa wersja formatu Gemini. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Wpływa na różnorodność odpowiedzi: im wyższa wartość, tym bardziej losowy wynik, im niższa — tym bardziej przewidywalny. |
top_p | 1 | — | Ogranicza wybór udziałów najbardziej prawdopodobnych tokenów: brane pod uwagę są tylko te, których sumaryczne prawdopodobieństwo daje P. |
max_tokens | — | — | Górny limit liczby tokenów, które model może wygenerować w odpowiedzi. |
presence_penalty | 0 | — | Obniża prawdopodobieństwo tokena, jeśli już wystąpił w tekście — model chętniej przechodzi do nowych tematów. |
frequency_penalty | 0 | — | Obniża prawdopodobieństwo tokenu proporcjonalnie do tego, jak często już się pojawiał — walczy z powtórzeniami. |
stop | — | — | Lista ciągów ograniczających: generowanie jest przerywane, gdy model wyemituje którykolwiek z nich. |
seed | — | — | Ustala losowość: ponowne zapytanie z tym samym seed i tymi samymi parametrami daje ten sam wynik. |
response_format | — | — | Format odpowiedzi: zwykły tekst lub ścisły JSON według określonego schematu. |
stream | false | — | Zwracać odpowiedź strumieniem w miarę generowania, a nie jednorazowo na końcu. |