NeuralBridgeDocumentation

moondream3.1 9b a2b

unofficialvision
DeveloperMoondream
Identifiermoondream/moondream3.1-9b-a2b-08130

moondream3.1 9b a2b specifications

Context window
Max output tokens28672
Release date
InputText, Image
OutputText

moondream3.1 9b a2b pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens60per 1M tokens
Output tokens200per 1M tokens

Prices are in rubles and may change with exchange rates.

What moondream3.1 9b a2b can do

moondream3.1 9b a2b API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

cURL

curl https://api.neuralbridge.ru/v1/vision \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "moondream/moondream3.1-9b-a2b-08130", "image": "data:image/png;base64,...", "prompt": "Что на картинке?"}'

API endpoints

POST /v1/visionprimaryVision
Bild­erkennung: Beschreibung, Antworten auf Fragen zum Bild, Objektsuche und Koordinaten.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Beeinflusst die Vielfalt der Antwort: Je höher der Wert, desto zufälliger die Ausgabe, je niedriger – desto vorhersehbarer.
top_p1Begrenzt die Auswahl der wahrscheinlichsten Token-Anteile: Es werden nur die berücksichtigt, deren Wahrscheinlichkeiten zusammen P ergeben.
max_tokensObergrenze der Token-Anzahl, die das Modell in der Antwort generieren kann.
presence_penalty0Reduziert die Wahrscheinlichkeit eines Tokens, wenn er bereits im Text vorkam – das Modell wechselt eher zu neuen Themen.
frequency_penalty0Reduziert die Token‑Wahrscheinlichkeit proportional zu seiner bisherigen Häufigkeit – bekämpft Wiederholungen.
stopListe von Begrenzungsstrings: Die Generierung wird unterbrochen, sobald das Modell einen davon ausgibt.
seedFixiert die Zufälligkeit: Eine wiederholte Anfrage mit demselben seed und denselben Parametern liefert das gleiche Ergebnis.
response_formatAntwortformat: normaler Text oder striktes JSON nach vorgegebener Schema.
streamfalseAntwort als Stream während der Generierung ausgeben, statt sie am Ende als einen Block zu senden.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά