Grok 3
unofficialchat
Grok 3 specifications
| Context window | 131K |
|---|---|
| Max output tokens | — |
| Release date | 2025-02-17 |
| Input | Text |
| Output | Text |
Grok 3 pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 250 ₽ per 1M tokens |
| Output tokens | 500 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What Grok 3 can do
- Function calling
- feature.ide
- Streaming responses
Grok 3 API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="xai/grok-3-11594",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "xai/grok-3-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "xai/grok-3-11594",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Основна ручка чату: приймає історію повідомлень і повертає відповідь моделі. Підтримує потоковий та звичайний режими. |
POST /v1/responses | Responses Альтернативний формат чату зі станом і структурованим виводом. |
POST /v1/messages | Messages Формат Anthropic: той же чат для клієнтів і SDK, написаних під Claude. |
POST /v1/converse | Converse Формат Amazon Bedrock Converse — для клієнтів, написаних під нього. |
POST /v1/converse-stream | Converse Stream Потоковий варіант формату Bedrock Converse. |
POST /v1/generateContent | Генерувати контент Формат Google Gemini — для клієнтів і SDK, написаних під нього. |
POST /v1/streamGenerateContent | Stream Generate Content Потоковий варіант формату Gemini. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Впливає на різноманітність відповіді: чим вище значення, тим випадковіший вивід, чим нижче — тим передбачуваніший. |
top_p | 1 | — | Обмежує вибір часток найймовірніших токенів: враховуються лише ті, чиї ймовірності в сумі дають P. |
max_tokens | — | — | Верхня межа кількості токенів, які модель може згенерувати у відповіді. |
presence_penalty | 0 | — | Знижує ймовірність токена, якщо він вже зустрічався в тексті — модель охоче переходить до нових тем. |
frequency_penalty | 0 | — | Знижує ймовірність token пропорційно тому, як часто він вже зустрічався — бореться з повтореннями. |
stop | — | — | Список рядків-обмежувачів: генерація переривається, як тільки модель видає будь-який з них. |
seed | — | — | Фіксує випадковість: повторний запит з тим же seed і тими ж параметрами дає той самий результат. |
response_format | — | — | Формат відповіді: звичайний текст або строгий JSON за заданою схемою. |
stream | false | — | Віддавати відповідь потоком у міру генерації, а не одним куском в кінці. |
tools | — | — | — |
parallel_tool_calls | — | — | — |