NeuralBridgeDocumentation

moondream3.1 9b a2b

unofficialvision
DeveloperMoondream
Identifiermoondream/moondream3.1-9b-a2b-08130

moondream3.1 9b a2b specifications

Context window
Max output tokens28672
Release date
InputText, Image
OutputText

moondream3.1 9b a2b pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens60per 1M tokens
Output tokens200per 1M tokens

Prices are in rubles and may change with exchange rates.

What moondream3.1 9b a2b can do

moondream3.1 9b a2b API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

cURL

curl https://api.neuralbridge.ru/v1/vision \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "moondream/moondream3.1-9b-a2b-08130", "image": "data:image/png;base64,...", "prompt": "Что на картинке?"}'

API endpoints

POST /v1/visionprimaryVisione
Riconoscimento dell'immagine: descrizione, risposte alle domande sull'immagine, ricerca di oggetti e coordinate.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Influisce sulla varietà della risposta: più alto è il valore, più casuale è l'output, più basso — più prevedibile.
top_p1Limita la selezione delle frazioni dei token più probabili: vengono considerati solo quelli le cui probabilità sommate danno P.
max_tokensLimite superiore del numero di token che il modello può generare nella risposta.
presence_penalty0Riduce la probabilità di un token se è già comparso nel testo — il modello passa più volentieri a nuovi argomenti.
frequency_penalty0Riduce la probabilità del token proporzionalmente a quanto è già stato incontrato — combatte le ripetizioni.
stopElenco di stringhe delimitatrici: la generazione si interrompe non appena il modello produce una di esse.
seedFissa la casualità: una nuova richiesta con lo stesso seed e gli stessi parametri restituisce lo stesso risultato.
response_formatFormato della risposta: testo normale o JSON rigoroso secondo lo schema specificato.
streamfalseRestituire la risposta in streaming man mano che viene generata, invece di un unico blocco alla fine.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά