NeuralBridgeDocumentation

moondream3.1 9b a2b

unofficialvision
DeveloperMoondream
Identifiermoondream/moondream3.1-9b-a2b-08130

moondream3.1 9b a2b specifications

Context window
Max output tokens28672
Release date
InputText, Image
OutputText

moondream3.1 9b a2b pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens60per 1M tokens
Output tokens200per 1M tokens

Prices are in rubles and may change with exchange rates.

What moondream3.1 9b a2b can do

moondream3.1 9b a2b API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

cURL

curl https://api.neuralbridge.ru/v1/vision \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "moondream/moondream3.1-9b-a2b-08130", "image": "data:image/png;base64,...", "prompt": "Что на картинке?"}'

API endpoints

POST /v1/visionprimaryVisión
Reconocimiento de imágenes: descripción, respuestas a preguntas sobre la imagen, búsqueda de objetos y coordenadas.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Afecta la diversidad de la respuesta: cuanto mayor el valor, más aleatoria la salida; cuanto menor, más predecible.
top_p1Limita la selección de las fracciones de los tokens más probables: solo se consideran aquellos cuya probabilidad sumada alcanza P.
max_tokensLímite superior del número de tokens que el modelo puede generar en la respuesta.
presence_penalty0Reduce la probabilidad del token si ya ha aparecido en el texto — el model pasa más fácilmente a nuevos temas.
frequency_penalty0Reduce la probabilidad del token proporcionalmente a la frecuencia con la que ya ha aparecido — combate repeticiones.
stopLista de cadenas delimitadoras: la generación se detiene tan pronto como el modelo produce cualquiera de ellas.
seedFija la aleatoriedad: una solicitud repetida con el mismo seed y los mismos parámetros produce el mismo resultado.
response_formatFormato de respuesta: texto plano o JSON estricto según el esquema especificado.
streamfalseEntregar la respuesta en streaming a medida que se genera, en lugar de un solo bloque al final.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά