o4 Mini
unofficialchat
o4 Mini specifications
| Context window | 200K |
|---|---|
| Max output tokens | 100000 |
| Release date | 2025-04-16 |
| Input | Text |
| Output | Text |
o4 Mini pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 220 ₽ per 1M tokens |
| Output tokens | 880 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What o4 Mini can do
- Function calling
- Streaming responses
o4 Mini API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="openai/o4-mini-11594",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "openai/o4-mini-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/o4-mini-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Hoofd‑chat‑endpoint: accepteert berichtgeschiedenis en retourneert modelantwoord. Ondersteunt streaming‑ en normale modi. |
POST /v1/responses | Responses Alternatief chatformaat met status en gestructureerde output. |
POST /v1/messages | Berichten Anthropic-formaat: dezelfde chat voor klanten en SDK's die voor Claude geschreven zijn. |
POST /v1/converse | Converse Amazon Bedrock Converse‑formaat — voor clients die er voor zijn geschreven. |
POST /v1/converse-stream | Converse Stream Streaming‑variant van het Bedrock Converse‑formaat. |
POST /v1/generateContent | Genereer inhoud Google Gemini-formaat — voor klanten en SDK's die er voor geschreven zijn. |
POST /v1/streamGenerateContent | Stream Generate Content Streamvariant van het Gemini-formaat. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Beïnvloedt de diversiteit van het antwoord: hoe hoger de waarde, hoe willekeuriger de output, hoe lager — hoe voorspelbaarder. |
top_p | 1 | — | Beperkt de selectie van de meest waarschijnlijke tokens: alleen die waarvan de cumulatieve waarschijnlijkheid P bereikt, worden meegenomen. |
max_tokens | — | — | Bovengrens van het aantal tokens dat het model kan genereren in het antwoord. |
presence_penalty | 0 | — | Vermindert de kans op een token als deze al in de tekst is voorgekomen — het model schakelt sneller over naar nieuwe onderwerpen. |
frequency_penalty | 0 | — | Vermindert de token‑kans evenredig aan hoe vaak deze al is voorgekomen — bestrijdt herhalingen. |
stop | — | — | Lijst van delimiter strings: de generatie wordt onderbroken zodra het model een van hen uitstuurt. |
seed | — | — | Fixeert de willekeur: een herhaald verzoek met dezelfde seed en dezelfde parameters geeft hetzelfde resultaat. |
response_format | — | — | Antwoordformaat: gewone tekst of strikte JSON volgens een opgegeven schema. |
stream | false | — | Antwoord streamen tijdens generatie in plaats van in één stuk aan het einde. |
tools | — | — | — |
parallel_tool_calls | — | — | — |