NeuralBridgeDocumentation

Muse Glimmer 30B

unofficialchat
DeveloperMeta
Identifiermeta-llama/muse-glimmer-30b-10238

Muse Glimmer 30B specifications

Context window131K
Max output tokens16384
Release date
InputText, Image
OutputText

Muse Glimmer 30B pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens32,81per 1M tokens
Output tokens120,34per 1M tokens

Prices are in rubles and may change with exchange rates.

What Muse Glimmer 30B can do

Muse Glimmer 30B API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="meta-llama/muse-glimmer-30b-10238",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "meta-llama/muse-glimmer-30b-10238",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/muse-glimmer-30b-10238",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Çatın əsas son nöqtəsi: mesaj tarixçəsini qəbul edir və modelin cavabını qaytarır. Axın və adi rejimləri dəstəkləyir.
POST /v1/responsesResponses
Vəziyyətlə və strukturlaşdırılmış çıxışla alternativ söhbət formatı.
POST /v1/messagesMessages
Anthropic formatı: Claude üçün yazılmış müştərilər və SDK üçün eyni söhbət.
POST /v1/converseConverse
Amazon Bedrock Converse formatı — ona uyğun yazılmış müştərilər üçün.
POST /v1/converse-streamConverse Stream
Bedrock Converse formatının axın variantı.
POST /v1/generateContentMəzmun Yarat
Google Gemini formatı — onun üçün yazılmış müştərilər və SDK üçün.
POST /v1/streamGenerateContentStream Generate Content
Gemini formatının axın variantı.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Cavabın müxtəlifliyinə təsir edir: dəyər nə qədər yüksəkdirsə, çıxış o qədər təsadüfi, aşağıdırsa — o qədər proqnozlaşdırıla biləndir.
top_p1Ən ehtimalı yüksək tokenlərin pay seçimlərini məhdudlaşdırır: yalnız ehtimallarının cəmi P verən tokenlər nəzərə alınır.
max_tokensModelin cavabda yarada biləcəyi tokenlərin üst həddi.
presence_penalty0Tokenin ehtimalını azaldır, əgər o, mətn içində artıq mövcuddursa — model yeni mövzulara daha çox keçməyə meyllidir.
frequency_penalty0Tokenin ehtimalını, onun artıq nə qədər tez-tez rast gəlinibsa, ona mütənasib azaldır — təkrarlamalara qarşı mübarizə aparır.
stopMəhdudlaşdırıcı sətirlərin siyahısı: model istənilən birini çıxardığı anda nəsil dayandırılır.
seedTəsadüfiliyi sabitləyir: eyni seed və eyni parametrlərlə təkrar sorğu eyni nəticəni verir.
response_formatCavab formatı: adi mətn və ya təyin edilmiş sxemaya uyğun sərt JSON.
streamfalseCavabı nəsil zamanı axın kimi göndər, sonradan bir blok kimi deyil.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά