NeuralBridgeDocumentation

Nemotron 3.5 Content Safety

unofficialchat
DeveloperNvidia
Identifiernvidia/nemotron-3.5-content-safety-10238

Nemotron 3.5 Content Safety specifications

Context window16K
Max output tokens4096
Release date
InputText, Image
OutputText

Nemotron 3.5 Content Safety pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens5,47per 1M tokens
Output tokens10,95per 1M tokens

Prices are in rubles and may change with exchange rates.

What Nemotron 3.5 Content Safety can do

Nemotron 3.5 Content Safety API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="nvidia/nemotron-3.5-content-safety-10238",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "nvidia/nemotron-3.5-content-safety-10238",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/nemotron-3.5-content-safety-10238",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Endpoint principal de chat: primește istoricul mesajelor și returnează răspunsul modelului. Suportă modurile streaming și normal.
POST /v1/responsesResponses
Format alternativ de chat cu stare și ieșire structurată.
POST /v1/messagesMesaje
Format Anthropic: același chat pentru clienți și SDK, scrise pentru Claude.
POST /v1/converseConverse
Formatul Amazon Bedrock Converse — pentru clienții scriși pentru el.
POST /v1/converse-streamConverse Stream
Varianta streaming a formatului Bedrock Converse.
POST /v1/generateContentGenerează conținut
Format Google Gemini — pentru clienți și SDK, scrise pentru el.
POST /v1/streamGenerateContentStream Generate Content
Variantă de flux a formatului Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Influențează diversitatea răspunsului: cu cât valoarea este mai mare, cu atât ieșirea este mai aleatorie, cu cât este mai mică — cu atât este mai predictibilă.
top_p1Limitează selecția părților celor mai probabile token: se iau în considerare doar cele ale căror probabilități însumate dau P.
max_tokensLimita superioară a numărului de tokeni pe care modelul îi poate genera în răspuns.
presence_penalty0Reduce probabilitatea unui token dacă a apărut deja în text – modelul trece mai ușor la subiecte noi.
frequency_penalty0Reduce probabilitatea tokenului proporțional cu frecvența cu care a apărut deja — combate repetițiile.
stopLista de șiruri-limită: generarea se întrerupe de îndată ce modelul emite oricare dintre ele.
seedFixează aleatorietatea: o cerere repetată cu același seed și aceiași parametri dă același rezultat.
response_formatFormatul răspunsului: text simplu sau JSON strict conform schemei specificate.
streamfalseLivrarea răspunsului ca flux pe măsură ce se generează, nu ca un singur bloc la final.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά