GPT-5.5 Pro
unofficialchat
GPT-5.5 Pro specifications
| Context window | 1.05M |
|---|---|
| Max output tokens | 128000 |
| Release date | 2026-04-23 |
| Input | Text |
| Output | Text |
GPT-5.5 Pro pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 6000 ₽ per 1M tokens |
| Output tokens | 36000 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What GPT-5.5 Pro can do
- Function calling
- feature.ide
- Streaming responses
GPT-5.5 Pro API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="openai/gpt-5.5-pro-11594",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "openai/gpt-5.5-pro-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.5-pro-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Haupt-Chat-Endpunkt: akzeptiert den Nachrichtenverlauf und gibt die Modellantwort zurück. Unterstützt Streaming- und Standardmodus. |
POST /v1/responses | Responses Alternative Chat-Format mit Zustand und strukturierter Ausgabe. |
POST /v1/messages | Messages Anthropic-Format: derselbe Chat für Kunden und SDKs, die für Claude geschrieben wurden. |
POST /v1/converse | Converse Amazon Bedrock Converse-Format — für darauf zugeschnittene Clients. |
POST /v1/converse-stream | Converse Stream Streaming-Variante des Bedrock Converse-Formats. |
POST /v1/generateContent | Inhalt generieren Google Gemini-Format — für Kunden und SDKs, die dafür geschrieben wurden. |
POST /v1/streamGenerateContent | Stream Generate Content Streaming-Variante des Gemini-Formats. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Beeinflusst die Vielfalt der Antwort: Je höher der Wert, desto zufälliger die Ausgabe, je niedriger – desto vorhersehbarer. |
top_p | 1 | — | Begrenzt die Auswahl der wahrscheinlichsten Token-Anteile: Es werden nur die berücksichtigt, deren Wahrscheinlichkeiten zusammen P ergeben. |
max_tokens | — | — | Obergrenze der Token-Anzahl, die das Modell in der Antwort generieren kann. |
presence_penalty | 0 | — | Reduziert die Wahrscheinlichkeit eines Tokens, wenn er bereits im Text vorkam – das Modell wechselt eher zu neuen Themen. |
frequency_penalty | 0 | — | Reduziert die Token‑Wahrscheinlichkeit proportional zu seiner bisherigen Häufigkeit – bekämpft Wiederholungen. |
stop | — | — | Liste von Begrenzungsstrings: Die Generierung wird unterbrochen, sobald das Modell einen davon ausgibt. |
seed | — | — | Fixiert die Zufälligkeit: Eine wiederholte Anfrage mit demselben seed und denselben Parametern liefert das gleiche Ergebnis. |
response_format | — | — | Antwortformat: normaler Text oder striktes JSON nach vorgegebener Schema. |
stream | false | — | Antwort als Stream während der Generierung ausgeben, statt sie am Ende als einen Block zu senden. |
tools | — | — | — |
parallel_tool_calls | — | — | — |