moondream3.1 9b a2b
unofficialvision
moondream3.1 9b a2b specifications
| Context window | — |
|---|---|
| Max output tokens | 28672 |
| Release date | — |
| Input | Text, Image |
| Output | Text |
moondream3.1 9b a2b pricing in rubles
You pay for what you use, per token and per unit. The final request cost is returned in the API response.
| Type | Price |
|---|---|
| Input tokens | 60 ₽ per 1M tokens |
| Output tokens | 200 ₽ per 1M tokens |
Prices are in rubles and may change with exchange rates.
What moondream3.1 9b a2b can do
- Image understanding
- Reasoning mode
moondream3.1 9b a2b API: connection and code examples
The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.
cURL
curl https://api.neuralbridge.ru/v1/vision \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "moondream/moondream3.1-9b-a2b-08130", "image": "data:image/png;base64,...", "prompt": "Что на картинке?"}'API endpoints
POST /v1/visionprimary | Vision Bilderkennung: Beschreibung, Antworten auf Fragen zum Bild, Objektsuche und Koordinaten. |
Supported request parameters
| Parameter | Default | Allowed values | Description |
|---|---|---|---|
temperature | 1 | — | Beeinflusst die Vielfalt der Antwort: Je höher der Wert, desto zufälliger die Ausgabe, je niedriger – desto vorhersehbarer. |
top_p | 1 | — | Begrenzt die Auswahl der wahrscheinlichsten Token-Anteile: Es werden nur die berücksichtigt, deren Wahrscheinlichkeiten zusammen P ergeben. |
max_tokens | — | — | Obergrenze der Token-Anzahl, die das Modell in der Antwort generieren kann. |
presence_penalty | 0 | — | Reduziert die Wahrscheinlichkeit eines Tokens, wenn er bereits im Text vorkam – das Modell wechselt eher zu neuen Themen. |
frequency_penalty | 0 | — | Reduziert die Token‑Wahrscheinlichkeit proportional zu seiner bisherigen Häufigkeit – bekämpft Wiederholungen. |
stop | — | — | Liste von Begrenzungsstrings: Die Generierung wird unterbrochen, sobald das Modell einen davon ausgibt. |
seed | — | — | Fixiert die Zufälligkeit: Eine wiederholte Anfrage mit demselben seed und denselben Parametern liefert das gleiche Ergebnis. |
response_format | — | — | Antwortformat: normaler Text oder striktes JSON nach vorgegebener Schema. |
stream | false | — | Antwort als Stream während der Generierung ausgeben, statt sie am Ende als einen Block zu senden. |