NeuralBridgeDocumentation

Kimi K3

unofficialchat
DeveloperMoonshotai
Identifiermoonshotai/kimi-k3-11594

Kimi K3 specifications

Context window1.05M
Max output tokens1048576
Release date
InputText
OutputText

Kimi K3 pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens600per 1M tokens
Output tokens3000per 1M tokens

Prices are in rubles and may change with exchange rates.

What Kimi K3 can do

Kimi K3 API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="moonshotai/kimi-k3-11594",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "moonshotai/kimi-k3-11594",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "moonshotai/kimi-k3-11594",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Endpoint principal de chat: aceita o histórico de mensagens e devolve a resposta do modelo. Suporta modos streaming e padrão.
POST /v1/responsesResponses
Formato alternativo de chat com estado e saída estruturada.
POST /v1/messagesMessages
Formato Anthropic: o mesmo chat para clientes e SDKs desenvolvidos para Claude.
POST /v1/converseConverse
Formato Amazon Bedrock Converse — para clientes desenvolvidos para ele.
POST /v1/converse-streamConverse Stream
Versão streaming do formato Bedrock Converse.
POST /v1/generateContentGenerate Content
Formato Google Gemini — para clientes e SDKs desenvolvidos para ele.
POST /v1/streamGenerateContentStream Generate Content
Versão em streaming do formato Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1Afeta a diversidade da resposta: quanto maior o valor, mais aleatória a saída; quanto menor, mais previsível.
top_p1Limita a seleção das frações dos tokens mais prováveis: são considerados apenas aqueles cujas probabilidades somam até P.
max_tokensLimite superior do número de tokens que o modelo pode gerar na resposta.
presence_penalty0Reduz a probabilidade de um token se ele já apareceu no texto — o modelo tende a mudar para novos tópicos.
frequency_penalty0Reduz a probabilidade do token proporcionalmente à frequência com que já apareceu — combate repetições.
stopLista de strings delimitadoras: a geração é interrompida assim que o modelo produz qualquer uma delas.
seedFixa a aleatoriedade: uma nova solicitação com o mesmo seed e os mesmos parâmetros produz o mesmo resultado.
response_formatFormato da resposta: texto simples ou JSON estrito conforme o esquema definido.
streamfalseEnviar a resposta como fluxo à medida que é gerada, em vez de um único bloco ao final.
tools
parallel_tool_calls
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά