moondream3.1 9b a2b
unofficialvision
moondream3.1 9b a2b specifications
| Context window | — |
|---|---|
| Max output tokens | 28672 |
| Release date | — |
| Input | Text, Image |
| Output | Text |
moondream3.1 9b a2b pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 60 ₽ per 1M tokens |
| Output tokens | 200 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What moondream3.1 9b a2b can do
- Image understanding
- Reasoning mode
moondream3.1 9b a2b API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
cURL
curl https://api.neuralbridge.ru/v1/vision \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "moondream/moondream3.1-9b-a2b-08130", "image": "data:image/png;base64,...", "prompt": "Что на картинке?"}'API endpoints
POST /v1/visionprimary | Visione Riconoscimento dell'immagine: descrizione, risposte alle domande sull'immagine, ricerca di oggetti e coordinate. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Influisce sulla varietà della risposta: più alto è il valore, più casuale è l'output, più basso — più prevedibile. |
top_p | 1 | — | Limita la selezione delle frazioni dei token più probabili: vengono considerati solo quelli le cui probabilità sommate danno P. |
max_tokens | — | — | Limite superiore del numero di token che il modello può generare nella risposta. |
presence_penalty | 0 | — | Riduce la probabilità di un token se è già comparso nel testo — il modello passa più volentieri a nuovi argomenti. |
frequency_penalty | 0 | — | Riduce la probabilità del token proporzionalmente a quanto è già stato incontrato — combatte le ripetizioni. |
stop | — | — | Elenco di stringhe delimitatrici: la generazione si interrompe non appena il modello produce una di esse. |
seed | — | — | Fissa la casualità: una nuova richiesta con lo stesso seed e gli stessi parametri restituisce lo stesso risultato. |
response_format | — | — | Formato della risposta: testo normale o JSON rigoroso secondo lo schema specificato. |
stream | false | — | Restituire la risposta in streaming man mano che viene generata, invece di un unico blocco alla fine. |