NeuralBridgeDocumentation

Kimi K2.7 Code

unofficialchat
DeveloperMoonshot AI
Identifiermoonshotai/kimi-k2.7-code-12544

Kimi K2.7 Code specifications

Context window256K
Max output tokens262144
Release date—
InputText
OutputText

Kimi K2.7 Code pricing in rubles

You pay for what you use, per token and per unit. The final request cost is returned in the API response.

TypePrice
Input tokens121,99 ₽ per 1M tokens
Output tokens853,94 ₽ per 1M tokens

Prices are in rubles and may change with exchange rates.

What Kimi K2.7 Code can do

Kimi K2.7 Code API: connection and code examples

The service exposes a single OpenAI-compatible API. Set our base_url and the key from your dashboard.

OpenAI Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.neuralbridge.ru/v1",
)

response = client.chat.completions.create(
    model="moonshotai/kimi-k2.7-code-12544",
    messages=[{"role": "user", "content": "Привет! Расскажи о себе."}],
)

print(response.choices[0].message.content)

Python (requests)

import requests

response = requests.post(
    "https://api.neuralbridge.ru/v1/chat/completions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "moonshotai/kimi-k2.7-code-12544",
        "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}],
    },
)

print(response.json()["choices"][0]["message"]["content"])

cURL

curl https://api.neuralbridge.ru/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "moonshotai/kimi-k2.7-code-12544",
    "messages": [{"role": "user", "content": "Привет! Расскажи о себе."}]
  }'

API endpoints

POST /v1/chat/completionsprimaryChat Completions
Endpoint principale della chat: accetta la cronologia dei messaggi e restituisce la risposta del modello. Supporta modalità streaming e normale.
POST /v1/responsesResponses
Formato alternativo di chat con stato e output strutturato.
POST /v1/messagesMessaggi
Formato Anthropic: la stessa chat per clienti e SDK scritti per Claude.
POST /v1/converseConverse
Formato Amazon Bedrock Converse — per i client sviluppati per esso.
POST /v1/converse-streamConverse Stream
Versione streaming del formato Bedrock Converse.
POST /v1/generateContentGenera Contenuto
Formato Google Gemini — per clienti e SDK scritti per esso.
POST /v1/streamGenerateContentStream Generate Content
Versione streaming del formato Gemini.

Supported request parameters

ParameterDefaultAllowed valuesDescription
temperature1—Influisce sulla varietà della risposta: più alto è il valore, più casuale è l'output, più basso — più prevedibile.
top_p1—Limita la selezione delle frazioni dei token più probabili: vengono considerati solo quelli le cui probabilità sommate danno P.
max_tokens——Limite superiore del numero di token che il modello può generare nella risposta.
presence_penalty0—Riduce la probabilità di un token se è già comparso nel testo — il modello passa più volentieri a nuovi argomenti.
frequency_penalty0—Riduce la probabilità del token proporzionalmente a quanto è già stato incontrato — combatte le ripetizioni.
stop——Elenco di stringhe delimitatrici: la generazione si interrompe non appena il modello produce una di esse.
seed——Fissa la casualità: una nuova richiesta con lo stesso seed e gli stessi parametri restituisce lo stesso risultato.
response_format——Formato della risposta: testo normale o JSON rigoroso secondo lo schema specificato.
streamfalse—Restituire la risposta in streaming man mano che viene generata, invece di un unico blocco alla fine.
tools———
Language:РусскийEnglishУкраїнськаБеларускаяҚазақшаOʻzbekchaКыргызчаТоҷикӣՀայերենAzərbaycancaTürkmençeRomânăDeutschFrançaisEspañolItalianoPortuguêsPolskiNederlandsTürkçeΕλληνικά