NeuralBridgeDocumentation

GPT 4.1

unofficialchat
DeveloperOpenai
Identifieropenai/gpt-4.1-11594

GPT 4.1 specifications

Context window1.05M
Max output tokens32768
Release date2025-04-14
InputText
OutputText

GPT 4.1 pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens400per 1M tokens
Output tokens1600per 1M tokens

Prices are in rubles and may change with exchange rates.

What GPT 4.1 can do

GPT 4.1 API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="openai/gpt-4.1-11594",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "openai/gpt-4.1-11594",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4.1-11594",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Endpoint principal de chat: primește istoricul mesajelor și returnează răspunsul modelului. Suportă modurile streaming și normal.
POST /v1/responsesResponses
Format alternativ de chat cu stare și ieșire structurată.
POST /v1/messagesMesaje
Format Anthropic: același chat pentru clienți și SDK, scrise pentru Claude.
POST /v1/converseConverse
Formatul Amazon Bedrock Converse — pentru clienții scriși pentru el.
POST /v1/converse-streamConverse Stream
Varianta streaming a formatului Bedrock Converse.
POST /v1/generateContentGenerează conținut
Format Google Gemini — pentru clienți și SDK, scrise pentru el.
POST /v1/streamGenerateContentStream Generate Content
Variantă de flux a formatului Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Influențează diversitatea răspunsului: cu cât valoarea este mai mare, cu atât ieșirea este mai aleatorie, cu cât este mai mică — cu atât este mai predictibilă.
top_p1Limitează selecția părților celor mai probabile token: se iau în considerare doar cele ale căror probabilități însumate dau P.
max_tokensLimita superioară a numărului de tokeni pe care modelul îi poate genera în răspuns.
presence_penalty0Reduce probabilitatea unui token dacă a apărut deja în text – modelul trece mai ușor la subiecte noi.
frequency_penalty0Reduce probabilitatea tokenului proporțional cu frecvența cu care a apărut deja — combate repetițiile.
stopLista de șiruri-limită: generarea se întrerupe de îndată ce modelul emite oricare dintre ele.
seedFixează aleatorietatea: o cerere repetată cu același seed și aceiași parametri dă același rezultat.
response_formatFormatul răspunsului: text simplu sau JSON strict conform schemei specificate.
streamfalseLivrarea răspunsului ca flux pe măsură ce se generează, nu ca un singur bloc la final.
tools
parallel_tool_calls
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά