GPT 5.3 Instant
unofficialchat
GPT 5.3 Instant specifications
| Context window | 400K |
|---|---|
| Max output tokens | 128000 |
| Release date | — |
| Input | Text |
| Output | Text |
GPT 5.3 Instant pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 350 ₽ per 1M tokens |
| Output tokens | 2800 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What GPT 5.3 Instant can do
- Function calling
- feature.ide
- Streaming responses
GPT 5.3 Instant API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="openai/gpt-5.3-instant-11594",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "openai/gpt-5.3-instant-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.3-instant-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Endpoint principal de chat: primește istoricul mesajelor și returnează răspunsul modelului. Suportă modurile streaming și normal. |
POST /v1/responses | Responses Format alternativ de chat cu stare și ieșire structurată. |
POST /v1/messages | Mesaje Format Anthropic: același chat pentru clienți și SDK, scrise pentru Claude. |
POST /v1/converse | Converse Formatul Amazon Bedrock Converse — pentru clienții scriși pentru el. |
POST /v1/converse-stream | Converse Stream Varianta streaming a formatului Bedrock Converse. |
POST /v1/generateContent | Generează conținut Format Google Gemini — pentru clienți și SDK, scrise pentru el. |
POST /v1/streamGenerateContent | Stream Generate Content Variantă de flux a formatului Gemini. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Influențează diversitatea răspunsului: cu cât valoarea este mai mare, cu atât ieșirea este mai aleatorie, cu cât este mai mică — cu atât este mai predictibilă. |
top_p | 1 | — | Limitează selecția părților celor mai probabile token: se iau în considerare doar cele ale căror probabilități însumate dau P. |
max_tokens | — | — | Limita superioară a numărului de tokeni pe care modelul îi poate genera în răspuns. |
presence_penalty | 0 | — | Reduce probabilitatea unui token dacă a apărut deja în text – modelul trece mai ușor la subiecte noi. |
frequency_penalty | 0 | — | Reduce probabilitatea tokenului proporțional cu frecvența cu care a apărut deja — combate repetițiile. |
stop | — | — | Lista de șiruri-limită: generarea se întrerupe de îndată ce modelul emite oricare dintre ele. |
seed | — | — | Fixează aleatorietatea: o cerere repetată cu același seed și aceiași parametri dă același rezultat. |
response_format | — | — | Formatul răspunsului: text simplu sau JSON strict conform schemei specificate. |
stream | false | — | Livrarea răspunsului ca flux pe măsură ce se generează, nu ca un singur bloc la final. |
tools | — | — | — |
parallel_tool_calls | — | — | — |