mistral small 3.1 24b instruct
unofficialchat
mistral small 3.1 24b instruct specifications
| Context window | 128K |
|---|---|
| Max output tokens | 128000 |
| Release date | — |
| Input | Text |
| Output | Text |
mistral small 3.1 24b instruct pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 45,63 ₽ per 1M tokens |
| Output tokens | 72,15 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What mistral small 3.1 24b instruct can do
- Function calling
- feature.ide
- Streaming responses
mistral small 3.1 24b instruct API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
OpenAI Python SDK
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.neuralbridge.ru/v1",
)
response = client.chat.completions.create(
model="mistralai/mistral-small-3.1-24b-instruct-08130",
messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)
print(response.choices[0].message.content)Python (requests)
import requests
response = requests.post(
"https://api.neuralbridge.ru/v1/chat/completions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "mistralai/mistral-small-3.1-24b-instruct-08130",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
},
)
print(response.json()["choices"][0]["message"]["content"])cURL
curl https://api.neuralbridge.ru/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mistralai/mistral-small-3.1-24b-instruct-08130",
"messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
}'API endpoints
POST /v1/chat/completionsprimary | Chat Completions Chat-ի հիմնական endpoint-ը՝ ընդունում է հաղորդագրությունների պատմությունը և վերադարձնում է model-ի պատասխանը։ Աջակցում է հոսքային և սովորական ռեժիմներին։ |
POST /v1/responses | Responses Փոխարինող զրույցի ձևաչափ՝ վիճակով և կառուցվածքային ելքով։ |
POST /v1/messages | Messages Anthropic ձևաչափ՝ նույն չատը հաճախորդների և SDK-ների համար, որոնք գրված են Claude-ի համար. |
POST /v1/converse | Converse Amazon Bedrock Converse ֆորմատը՝ այն հաճախորդների համար, որոնք գրված են դրա համար։ |
POST /v1/converse-stream | Converse Stream Bedrock Converse ֆորմատի հոսքային տարբերակը։ |
POST /v1/generateContent | Ստեղծել բովանդակություն Google Gemini ձևաչափ — հաճախորդների և SDK-ների համար, որոնք գրված են դրա համար. |
POST /v1/streamGenerateContent | Stream Generate Content Gemini ձևաչափի հոսքային տարբերակ։ |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Ազդում է պատասխանի բազմազանության վրա՝ որքան բարձր արժեքը, այնքան ավելի պատահական է ելքը, իսկ որքան ցածր՝ այնքան ավելի կանխատեսելի։ |
top_p | 1 | — | Սահմանափակում է ամենաավելի հավանական տոկենների բաժինների ընտրությունը՝ հաշվում են միայն այն, որոնց հավանականությունների գումարը հավասար է P-ին։ |
max_tokens | — | — | Token-ների թվի վերին սահմանը, որոնք model-ը կարող է գեներացնել պատասխանում։ |
presence_penalty | 0 | — | Նվազեցնում է token-ի հավանականությունը, եթե այն արդեն հանդիպել է տեքստում՝ model-ը ավելի շուտ անցնում է նոր թեմաներ։ |
frequency_penalty | 0 | — | Նվազեցնում է token-ի հավանականությունը համաչափ այն հաճախականությանը, ինչքանից այն արդեն հանդիպել է — պայքարում է կրկնությունների դեմ. |
stop | — | — | Սահմանափակող տողերի ցանկը՝ գեներացիան դադարեցնում է, երբ մոդելը արտածում է որևէ մեկը։ |
seed | — | — | Ֆիքսում է պատահականությունը՝ նույն seed‑ը և նույն պարամետրերով կրկնակի հարցումը տալիս նույն արդյունքը։ |
response_format | — | — | Պատասխանի ֆորմատը՝ սովորական տեքստ կամ խիստ JSON՝ ըստ սահմանված սխեմայի։ |
stream | false | — | Պատասխանը պետք է ուղարկվի հոսքով գեներացիայի ընթացքում, ոչ թե մեկ կտորով վերջում։ |
tools | — | — | — |
tool_choice | — | — | — |
parallel_tool_calls | — | — | — |