NeuralBridgeDocumentation

Muse Glimmer 30B

unofficialchat
DeveloperMeta
Identifiermeta-llama/muse-glimmer-30b-10238

Muse Glimmer 30B specifications

Context window131K
Max output tokens16384
Release date
InputText, Image
OutputText

Muse Glimmer 30B pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens32,81per 1M tokens
Output tokens120,34per 1M tokens

Prices are in rubles and may change with exchange rates.

What Muse Glimmer 30B can do

Muse Glimmer 30B API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="meta-llama/muse-glimmer-30b-10238",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "meta-llama/muse-glimmer-30b-10238",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/muse-glimmer-30b-10238",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Κύρια μέθοδος συνομιλίας: δέχεται το ιστορικό μηνυμάτων και επιστρέφει την απάντηση του μοντέλου. Υποστηρίζει ροή και κανονική λειτουργία.
POST /v1/responsesResponses
Εναλλακτική μορφή συνομιλίας με κατάσταση και δομημένη έξοδο.
POST /v1/messagesMessages
Μορφή Anthropic: η ίδια συνομιλία για πελάτες και SDK που έχουν γραφτεί για Claude.
POST /v1/converseConverse
Μορφή Amazon Bedrock Converse — για πελάτες που έχουν γραφτεί για αυτήν.
POST /v1/converse-streamConverse Stream
Ροή έκδοση της μορφής Bedrock Converse.
POST /v1/generateContentΔημιουργία Περιεχομένου
Μορφή Google Gemini — για πελάτες και SDK που έχουν γραφτεί για αυτό.
POST /v1/streamGenerateContentStream Generate Content
Έκδοση ροής της μορφής Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Επηρεάζει την ποικιλία της απάντησης: όσο υψηλότερη η τιμή, τόσο πιο τυχαία η έξοδος, όσο χαμηλότερη — τόσο πιο προβλέψιμη.
top_p1Περιορίζει την επιλογή των μεριδίων των πιο πιθανών token: λαμβάνονται υπόψη μόνο εκείνα των οποίων οι πιθανότητες αθροίζονται σε P.
max_tokensΆνω όριο του αριθμού των token που το μοντέλο μπορεί να δημιουργήσει στην απάντηση.
presence_penalty0Μειώνει την πιθανότητα ενός token αν έχει ήδη εμφανιστεί στο κείμενο — το μοντέλο προτιμά να μεταβεί σε νέα θέματα.
frequency_penalty0Μειώνει την πιθανότητα του token ανάλογα με το πόσο συχνά έχει ήδη εμφανιστεί — καταπολεμά τις επαναλήψεις.
stopΛίστα συμβολοσειρών-περιοριστών: η παραγωγή διακόπτεται μόλις το μοντέλο εκτυπώσει οποιαδήποτε από αυτές.
seedΚαθορίζει την τυχαιότητα: ένα επαναλαμβανόμενο αίτημα με το ίδιο seed και τις ίδιες παραμέτρους δίνει το ίδιο αποτέλεσμα.
response_formatΜορφή απάντησης: απλό κείμενο ή αυστηρό JSON σύμφωνα με το καθορισμένο σχήμα.
streamfalseΝα επιστρέφεται η απάντηση ροή κατά τη διάρκεια της παραγωγής, αντί να αποστέλλεται ως ένα ενιαίο τμήμα στο τέλος.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά