NeuralBridgeDocumentation

Llama 3.2 90B Vision Instruct

unofficialchat
DeveloperMeta
Identifiermeta-llama/llama-3.2-90b-vision-instruct-10238

Llama 3.2 90B Vision Instruct specifications

Context window131K
Max output tokens16384
Release date
InputText, Image
OutputText

Llama 3.2 90B Vision Instruct pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens21,88per 1M tokens
Output tokens76,14per 1M tokens

Prices are in rubles and may change with exchange rates.

What Llama 3.2 90B Vision Instruct can do

Llama 3.2 90B Vision Instruct API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="meta-llama/llama-3.2-90b-vision-instruct-10238",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "meta-llama/llama-3.2-90b-vision-instruct-10238",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.2-90b-vision-instruct-10238",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Ana sohbet uç noktası: mesaj geçmişini alır ve modelin yanıtını döndürür. Akış ve normal modları destekler.
POST /v1/responsesResponses
Durum ve yapılandırılmış çıktı ile alternatif sohbet formatı.
POST /v1/messagesMessages
Anthropic formatı: Claude için yazılmış istemciler ve SDK'lar için aynı sohbet.
POST /v1/converseConverse
Amazon Bedrock Converse formatı — ona göre yazılmış istemciler için.
POST /v1/converse-streamConverse Stream
Bedrock Converse formatının akış versiyonu.
POST /v1/generateContentİçerik Oluştur
Google Gemini formatı — onun için yazılmış istemciler ve SDK'lar için.
POST /v1/streamGenerateContentStream Generate Content
Gemini formatının akış sürümü.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Cevabın çeşitliliğini etkiler: değer ne kadar yüksekse çıktı o kadar rastgele, düşükse o kadar öngörülebilir.
top_p1En olası token paylarının seçimlerini sınırlar: yalnızca olasılıkları toplamı P olanlar dikkate alınır.
max_tokensModelin cevapta üretebileceği token sayısının üst sınırı.
presence_penalty0Metinde zaten görülmüşse token olasılığını azaltır — model yeni konulara daha istekli geçer.
frequency_penalty0Token olasılığını, tokenin daha önce ne kadar sık göründüğüne orantılı olarak azaltır — tekrarları önler.
stopDurdurma satırları listesi: model herhangi birini ürettiği anda üretim durur.
seedRastgeleliği sabitler: aynı seed ve aynı parametrelerle yapılan tekrar isteği aynı sonucu verir.
response_formatYanıt formatı: normal metin veya belirli şemaya göre katı JSON.
streamfalseYanıtı, üretim sırasında bir akış olarak gönder, sonunda tek bir parça olarak değil.
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά