NeuralBridgeDocumentation

Llama 3.2 11B Vision Instruct

unofficialchat
DeveloperMeta
Identifiermeta-llama/llama-3.2-11b-vision-instruct-10238

Llama 3.2 11B Vision Instruct specifications

Context window131K
Max output tokens16384
Release date
InputText, Image
OutputText

Llama 3.2 11B Vision Instruct pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens5,47per 1M tokens
Output tokens16,41per 1M tokens

Prices are in rubles and may change with exchange rates.

What Llama 3.2 11B Vision Instruct can do

Llama 3.2 11B Vision Instruct API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="meta-llama/llama-3.2-11b-vision-instruct-10238",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "meta-llama/llama-3.2-11b-vision-instruct-10238",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.2-11b-vision-instruct-10238",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Endpoint principal de chat: primește istoricul mesajelor și returnează răspunsul modelului. Suportă modurile streaming și normal.
POST /v1/responsesResponses
Format alternativ de chat cu stare și ieșire structurată.
POST /v1/messagesMesaje
Format Anthropic: același chat pentru clienți și SDK, scrise pentru Claude.
POST /v1/converseConverse
Formatul Amazon Bedrock Converse — pentru clienții scriși pentru el.
POST /v1/converse-streamConverse Stream
Varianta streaming a formatului Bedrock Converse.
POST /v1/generateContentGenerează conținut
Format Google Gemini — pentru clienți și SDK, scrise pentru el.
POST /v1/streamGenerateContentStream Generate Content
Variantă de flux a formatului Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Influențează diversitatea răspunsului: cu cât valoarea este mai mare, cu atât ieșirea este mai aleatorie, cu cât este mai mică — cu atât este mai predictibilă.
top_p1Limitează selecția părților celor mai probabile token: se iau în considerare doar cele ale căror probabilități însumate dau P.
max_tokensLimita superioară a numărului de tokeni pe care modelul îi poate genera în răspuns.
presence_penalty0Reduce probabilitatea unui token dacă a apărut deja în text – modelul trece mai ușor la subiecte noi.
frequency_penalty0Reduce probabilitatea tokenului proporțional cu frecvența cu care a apărut deja — combate repetițiile.
stopLista de șiruri-limită: generarea se întrerupe de îndată ce modelul emite oricare dintre ele.
seedFixează aleatorietatea: o cerere repetată cu același seed și aceiași parametri dă același rezultat.
response_formatFormatul răspunsului: text simplu sau JSON strict conform schemei specificate.
streamfalseLivrarea răspunsului ca flux pe măsură ce se generează, nu ca un singur bloc la final.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά