Документация API

Обзор

kimrel.com предоставляет независимый, OpenAI- и Anthropic-compatible API-интерфейс для доступа к Kimi K2 и связанным моделям. Kimi K2 разработана Moonshot AI, а kimrel.com не связан с Moonshot AI и не является продуктом, одобренным, поддержанным или спонсируемым Moonshot AI.

Базовый URL

https://kimrel.com/api

Поддерживаемые протоколы

  • REST API по HTTPS
  • JSON тела запросов и ответов
  • кодировка UTF-8
  • поддержка CORS для браузерных приложений

Быстрый старт

Начните использовать API kimrel.com за три шага:

  1. Создайте аккаунт и получите 10 бесплатных кредитов
  2. Сгенерируйте API ключ в вашем кабинете
  3. Сделайте первый запрос (использование списывается из credits по input и output tokens, с минимальным списанием для каждой модели)

Пример запроса

curl https://kimrel.com/api/v1/chat/completions \
  -H "Authorization: Bearer $KIMI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2-0905",
    "messages": [{"role": "user", "content": "Привет"}]
  }'

Инструменты для AI‑кодинга

kimrel.com предоставляет OpenAI‑совместимые (chat completions) и Claude‑совместимые (messages) эндпоинты, поэтому поддерживаемые модели легко подключать к популярным AI‑инструментам для программирования.

Поддержка моделей: kimi-k2, kimi-k2-0905, kimi-k2.5, kimi-k2.6, kimi-k2.7-code и kimi-k3 доступны через kimrel.com. Эти модели разработаны Moonshot AI; kimrel.com — независимый интерфейс, не связанный, не одобренный и не спонсируемый Moonshot AI. Выбирайте kimi-k3 для контекста 1M, анализа изображений, длительного программирования и сложных tool workflows; kimi-k2.7-code остаётся coding-focused K2 route.

Claude Code (рекомендуется)

Claude Code читает конфигурацию из ~/.claude/settings.json. Добавьте или обновите раздел env:

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://kimrel.com/api",
    "ANTHROPIC_AUTH_TOKEN": "<KIMREL_API_KEY>",
    "API_TIMEOUT_MS": "3000000",
    "CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC": 1,
    "ANTHROPIC_MODEL": "kimi-k2.5",
    "ANTHROPIC_SMALL_FAST_MODEL": "kimi-k2",
    "ANTHROPIC_DEFAULT_SONNET_MODEL": "kimi-k2.5",
    "ANTHROPIC_DEFAULT_OPUS_MODEL": "kimi-k2.5",
    "ANTHROPIC_DEFAULT_HAIKU_MODEL": "kimi-k2"
  }
}

После сохранения перезапустите Claude Code. Запросы будут отправляться на https://kimrel.com/api/v1/messages.

Codex

Установите Codex CLI:

npm i -g @openai/codex

Добавьте конфигурацию kimrel.com в ~/.codex/config.toml:

[model_providers.kimi-k2]
name = "kimrel.com Chat Completions API"
base_url = "https://kimrel.com/api/v1"
env_key = "KIMREL_API_KEY"
wire_api = "chat"
requires_openai_auth = false
request_max_retries = 4
stream_max_retries = 10
stream_idle_timeout_ms = 300000

[profiles.k2]
model = "kimi-k2"
model_provider = "kimi-k2"

[profiles.k2.5]
model = "kimi-k2.5"
model_provider = "kimi-k2"

Установите API‑ключ и запустите Codex:

export KIMREL_API_KEY="<YOUR_API_KEY>"

codex --profile k2.5

Аутентификация

API ключи

Аутентификация выполняется с помощью API ключей. Передайте ключ в заголовке запроса:

Authorization: Bearer YOUR_API_KEY

Или для Anthropic‑совместимых endpoints:

X-API-Key: YOUR_API_KEY

Способы аутентификации

МетодЗаголовокФорматЭндпоинты
Bearer TokenAuthorizationBearer YOUR_API_KEY/v1/chat/completions
API KeyX-API-KeyYOUR_API_KEY/v1/messages

Справочник API

Список моделей

Список всех доступных моделей, которые можно использовать через API.

Список доступных моделей

GET /v1/models

Возвращает список моделей, доступных через API.

Формат ответа

{
  "object": "list",
  "data": [
    {
      "id": "kimi-k2",
      "object": "model",
      "created": 1735785600,
      "owned_by": "moonshot-ai",
      "permission": [...],
      "root": "kimi-k2",
      "parent": null
    },
    {
      "id": "kimi-k2-0905",
      "object": "model",
      "created": 1735785600,
      "owned_by": "moonshot-ai",
      "permission": [...],
      "root": "kimi-k2-0905",
      "parent": null
    },
    {
      "id": "kimi-k2.5",
      "object": "model",
      "created": 1735785600,
      "owned_by": "moonshot-ai",
      "permission": [...],
      "root": "kimi-k2.5",
      "parent": null
    },
    {
      "id": "kimi-k2.6",
      "object": "model",
      "created": 1735785600,
      "owned_by": "moonshot-ai",
      "permission": [...],
      "root": "kimi-k2.6",
      "parent": null
    },
    {
      "id": "kimi-k2.7-code",
      "object": "model",
      "created": 1735785600,
      "owned_by": "moonshot-ai",
      "permission": [...],
      "root": "kimi-k2.7-code",
      "parent": null
    },
    {
      "id": "kimi-k3",
      "object": "model",
      "created": 1784160000,
      "owned_by": "moonshot-ai",
      "permission": [...],
      "root": "kimi-k3",
      "parent": null
    }
  ]
}
Поля ответа
ПолеТипОписание
objectstringВсегда list
dataarrayСписок доступных моделей
data[].idstringИдентификатор модели для запросов API
data[].objectstringВсегда model
data[].owned_bystringОрганизация‑владелец модели

Чат‑комплишены

Chat Completions API генерирует ответы модели для диалогов. Эндпоинт совместим с форматом OpenAI API.

Создать completion

POST /v1/chat/completions

Генерирует ответ модели для заданного диалога.

Формат запроса

{
  "model": "kimi-k2-0905",
  "messages": [
    {
      "role": "system",
      "content": "Вы — полезный помощник."
    },
    {
      "role": "user", 
      "content": "Объясните квантовые вычисления"
    }
  ],
  "temperature": 0.7,
  "max_tokens": 2048,
  "top_p": 1.0,
  "frequency_penalty": 0,
  "presence_penalty": 0,
  "stream": false,
  "n": 1
}
Параметры
ПараметрТипОбязателенЗначение по умолчаниюОписание
modelstringДа-Идентификатор модели. Используйте kimi-k2
messagesarrayДа-Входные сообщения. У каждого сообщения есть role и content
temperaturenumberНет0.6Температура сэмплирования (0–2). Меньшие значения дают более детерминированный вывод
max_tokensintegerНет1024Максимум токенов. Предел модели — 128000
top_pnumberНет1.0Порог nucleus sampling. Альтернатива temperature
frequency_penaltynumberНет0Штраф за повторяющиеся токены. Диапазон: -2.0…2.0
presence_penaltynumberНет0Штраф за присутствие токенов. Диапазон: -2.0…2.0
streambooleanНетfalseИнкрементальный стриминг ответов
nintegerНет1Количество генераций
stopstring/arrayНетnullСтоп‑последовательности (до 4)
userstringНетnullУникальный идентификатор пользователя для трекинга
Объект сообщения
ПолеТипОписание
rolestringОдно из: system, user, assistant
contentstringСодержимое сообщения

Формат ответа

{
  "id": "chatcmpl-9d4c2f68-5e3a-4b2f-a3c9-7d8e6f5c4b3a",
  "object": "chat.completion",
  "created": 1709125200,
  "model": "kimi-k2-0905",
  "system_fingerprint": "fp_a7c4d3e2",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Квантовые вычисления используют явления квантовой механики..."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 25,
    "completion_tokens": 189,
    "total_tokens": 214
  }
}
Поля ответа
ПолеТипОписание
idstringУникальный идентификатор запроса
objectstringТип объекта: chat.completion
createdintegerUnix timestamp
modelstringИспользуемая модель
choicesarrayСгенерированные completions
usageobjectСтатистика использования токенов
Причины завершения
ЗначениеОписание
stopЕстественное завершение или достигнута stop‑последовательность
lengthДостигнут лимит токенов

Стриминг

Формат Server‑Sent Events при stream: true:

data: {"id":"chatcmpl-...","choices":[{"delta":{"content":"Привет"},"index":0}]}

data: {"id":"chatcmpl-...","choices":[{"delta":{"content":" мир"},"index":0}]}

data: [DONE]

Сообщения

Messages API предоставляет Anthropic‑совместимую генерацию сообщений.

Создать сообщение

POST /v1/messages

Создаёт ответ модели в формате Messages.

Формат запроса

{
  "model": "kimi-k2-0905",
  "messages": [
    {
      "role": "user",
      "content": "Столица Франции?"
    }
  ],
  "max_tokens": 1024,
  "system": "Вы — знающий помощник по географии.",
  "temperature": 0.7,
  "top_p": 1.0,
  "stop_sequences": ["\n\nHuman:"]
}
Параметры
ПараметрТипОбязателенЗначение по умолчаниюОписание
modelstringДа-Идентификатор модели
messagesarrayДа-Сообщения диалога (только user/assistant)
max_tokensintegerДа-Максимум токенов для генерации
systemstringНетnullСистемный промпт для поведения
temperaturenumberНет0.6Температура сэмплирования (0–1)
top_pnumberНет1.0Порог nucleus sampling
stop_sequencesarrayНетnullСтоп‑последовательности (макс. 4)
streambooleanНетfalseВключить стриминг ответов
metadataobjectНетnullМетаданные запроса

Формат ответа

{
  "id": "msg_01XFDUDYJgAACzvnptvVoYEL",
  "type": "message",
  "role": "assistant",
  "content": [
    {
      "type": "text",
      "text": "Столица Франции — Париж."
    }
  ],
  "model": "kimi-k2-0905",
  "stop_reason": "end_turn",
  "stop_sequence": null,
  "usage": {
    "input_tokens": 15,
    "output_tokens": 9
  }
}
Поля ответа
ПолеТипОписание
idstringУникальный идентификатор сообщения
typestringТип объекта: message
rolestringВсегда assistant
contentarrayБлоки содержимого сообщения
modelstringИспользуемая модель
stop_reasonstringПричина остановки генерации
usageobjectИспользование токенов

Системные промпты

Системные промпты в Messages API задаются отдельно:

{
  "system": "Вы — Claude, AI‑ассистент, созданный Anthropic.",
  "messages": [
    {"role": "user", "content": "Привет"}
  ],
  "max_tokens": 1024
}

Модели

Ниже перечислены model IDs, которые kimrel.com предоставляет для supported model routes. Модели семейства Kimi K2 разработаны Moonshot AI; kimrel.com предоставляет независимый access layer, а не официальную product branding разработчика модели.

Доступные модели

Model IDContext WindowDescription
kimi-k2128,000 tokensОсновная модель для стандартных chat completions
kimi-k2-0905256,000 tokensУлучшенная модель с расширенным контекстом
kimi-k2.5256,000 tokensНативная мультимодальная agentic MoE модель (1T total / 32B active) с сильным tool use и reasoning
kimi-k2.6256,000 tokensK2.6 route на kimrel.com для text + image input, thinking mode и tool workflows
kimi-k2.7-code256,000 tokensCoding-focused K2 route для long-horizon software engineering, thinking mode, tool use и text + image input
kimi-k31,000,000 tokensФлагманская модель 2,8T с постоянным reasoning, нативным пониманием изображений, long-horizon coding, structured output и tool calling

Выбор модели

Выберите модель в зависимости от задач:

  • kimi-k2: лучше всего для общего диалога, генерации контента и стандартных задач
  • kimi-k2-0905: для задач с длинным контекстом (до 256K), например анализ целых документов или долгих диалогов
  • kimi-k2.5: нативная мультимодальная agentic‑модель, оптимизированная для tool use и reasoning с контекстом 256K
  • kimi-k2.6: рекомендуемый route для K2.6 workflow на kimrel.com с text + image understanding, thinking mode и tool calling. На этом сервисе video input не поддерживается.
  • kimi-k2.7-code: рекомендуется для long-horizon coding, coding agents, repository work и tool-assisted software engineering. На этом сервисе K2.7 Code поддерживает text и image input, но не video input.
  • kimi-k3: рекомендуется для сложных long-context agents, repository-scale engineering, visual reasoning, structured output и advanced tool workflows. K3 всегда выполняет reasoning; используйте верхнеуровневое reasoning_effort: "max", а не K2.x-объект thinking. Kimrel поддерживает text и images, но не video.

Ключевые характеристики Kimi‑K2.5: MoE‑архитектура (1T total, 32B active), контекст 256K и vision‑энкодер MoonViT.

kimi-k2.6 поддерживает thinking mode для workflow, где полезны более прозрачные reasoning traces и tool-assisted problem solving.

Быстрый старт с Kimi K3

Используйте kimi-k3 для флагманской модели Moonshot AI с 2,8 трлн параметров, контекстом 1M, нативным пониманием изображений, long-horizon coding и tool calling. K3 всегда выполняет reasoning. На OpenAI‑совместимом endpoint применяйте верхнеуровневое поле reasoning_effort; не отправляйте K2.x‑объект thinking.

OpenAI‑совместимый K3 reasoning request

{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Проверь этот план миграции, найди самое рискованное предположение и предложи порядок верификации."
    }
  ],
  "reasoning_effort": "max",
  "max_completion_tokens": 4096
}

OpenAI‑совместимый K3 запрос с изображением

{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "image_url",
          "image_url": {
            "url": "https://example.com/interface.png"
          }
        },
        {
          "type": "text",
          "text": "Опиши интерфейс и укажи наиболее вероятные проблемы доступности."
        }
      ]
    }
  ],
  "reasoning_effort": "max",
  "max_completion_tokens": 4096
}

На Anthropic‑совместимом /v1/messages endpoint установите model в kimi-k3 и передайте обязательное max_tokens; K3 по умолчанию использует max reasoning. В многошаговых tool workflows возвращайте полное assistant message в следующем запросе, чтобы сохранить reasoning и историю tool calls.

Быстрый старт с Kimi K2.6

kimi-k2.6 — это новейший K2.6 route, доступный через kimrel.com. Это лучший вариант на данном сервисе, если вам нужны более сильное reasoning, image understanding и tool-enabled workflows без изменения существующей OpenAI-compatible структуры запросов. На kimrel.com K2.6 поддерживает 256K context window, text + image inputs, tool calling и thinking mode на OpenAI-compatible endpoint /v1/chat/completions. Video input этим сервисом не поддерживается.

Когда вы отправляете изображения в kimi-k2.6, можно либо передать готовый data:image/...;base64,... URL, либо remote http(s) image URL. kimrel.com скачает изображение на сервере, выполнит проверки безопасности и размера, преобразует его в base64 и только затем отправит запрос upstream. Это удобно для screenshot-based workflows и image reasoning без необходимости самостоятельно кодировать изображение на клиенте.

OpenAI-compatible: K2.6 с thinking

{
  "model": "kimi-k2.6",
  "messages": [
    {
      "role": "user",
      "content": "Сначала подумай глубоко, затем кратко предложи лучший migration plan."
    }
  ],
  "thinking": { "type": "enabled" },
  "max_completion_tokens": 2048
}

OpenAI-compatible: K2.6 image understanding

{
  "model": "kimi-k2.6",
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "image_url",
          "image_url": {
            "url": "https://example.com/demo-ui.png"
          }
        },
        {
          "type": "text",
          "text": "Опиши изображение и перечисли основные элементы интерфейса."
        }
      ]
    }
  ],
  "max_completion_tokens": 2048
}

Для kimi-k2.6, kimi-k2.7-code и kimi-k3 kimrel.com принимает remote http(s) image URLs и автоматически преобразует их в base64 перед отправкой запроса upstream. Если у вас уже есть data:image/...;base64,..., его можно отправить напрямую. Video URLs этим сервисом отклоняются.

Ограничения image input на Kimrel:

  • Максимальный размер исходного изображения: 6MB
  • Максимальный размер encoded image payload после преобразования: 8MB
  • Поддерживаемые типы изображений: PNG, JPEG/JPG, WEBP, GIF
  • Remote image URLs должны использовать http(s) и загружаются на стороне сервиса перед отправкой upstream
  • Video input не поддерживается

Anthropic-compatible: K2.6 image input

{
  "model": "kimi-k2.6",
  "max_tokens": 2048,
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "image",
          "source": {
            "type": "url",
            "url": "https://example.com/demo-ui.png"
          }
        },
        {
          "type": "text",
          "text": "Опиши содержимое изображения."
        }
      ]
    }
  ]
}

Anthropic-compatible endpoint /v1/messages продолжает поддерживать существующие base64 image blocks. Автоматическая загрузка remote image URLs включена для kimi-k2.6, kimi-k2.7-code и kimi-k3, что соответствует текущему поведению сервиса.

Пример tool calling для K2.6

{
  "model": "kimi-k2.6",
  "messages": [
    {
      "role": "user",
      "content": "Используй weather tool, чтобы сравнить Пекин и Шанхай."
    }
  ],
  "tools": [
    {
      "type": "function",
      "function": {
        "name": "get_weather",
        "description": "Получить текущую погоду по городу",
        "parameters": {
          "type": "object",
          "properties": {
            "city": { "type": "string" }
          },
          "required": ["city"]
        }
      }
    }
  ],
  "tool_choice": "auto",
  "max_completion_tokens": 1024
}

Лимиты запросов

Лимиты скорости

Лимиты зависят от баланса кредитов на API ключе:

Баланс кредитовЗапросов/минЗапросов/часЗапросов/день
1-100206005,000
101-1,000602,00020,000
1,001-10,0002006,00050,000
10,000+50015,000100,000

Заголовки лимитов:

X-RateLimit-Limit: 60
X-RateLimit-Remaining: 59
X-RateLimit-Reset: 1709125800

Лимиты токенов

Тип лимитаЗначение
Максимум входных токенов128,000
Максимум выходных токенов8,192
Максимум всех токенов128,000

Настройки таймаута

Тип таймаутаДлительность
Таймаут соединения30 секунд
Таймаут чтения600 секунд
Таймаут стрима600 секунд

Коды ошибок

HTTP‑коды статуса

СтатусЗначение
200Success
400Bad Request - Invalid parameters
401Unauthorized - Invalid or missing API key
403Forbidden - Insufficient credits or permissions
404Not Found - Invalid endpoint
429Too Many Requests - Rate limit exceeded
500Internal Server Error
503Service Unavailable

Типы ошибок

Ошибки в формате OpenAI

{
  "error": {
    "message": "Invalid API key provided",
    "type": "invalid_request_error",
    "code": "invalid_api_key"
  }
}
Error CodeTypeDescription
invalid_api_keyinvalid_request_errorAPI ключ неверный или имеет неправильный формат
insufficient_creditsinsufficient_quotaНедостаточно кредитов
rate_limit_exceededrate_limit_errorСлишком много запросов
invalid_requestinvalid_request_errorОшибка валидации запроса
model_not_foundinvalid_request_errorУказанная модель не существует
context_length_exceededinvalid_request_errorВход превышает контекстное окно
encoded_image_too_largeinvalid_request_errorКодированная image payload превышает лимит безопасной передачи сервиса

Ошибки в формате Anthropic

{
  "type": "error",
  "error": {
    "type": "authentication_error",
    "message": "Invalid API key"
  }
}
Error TypeDescription
authentication_errorОшибка аутентификации
invalid_request_errorОшибка валидации запроса
rate_limit_errorПревышен лимит запросов
api_errorОшибка сервера

Обработка ошибок

Рекомендуется exponential backoff с jitter:

import time
import random

def retry_with_backoff(
    func, 
    max_retries=3,
    base_delay=1,
    max_delay=60
):
    for attempt in range(max_retries):
        try:
            return func()
        except RateLimitError:
            if attempt == max_retries - 1:
                raise
            
            delay = min(
                base_delay * (2 ** attempt) + random.uniform(0, 1),
                max_delay
            )
            time.sleep(delay)

Клиентские библиотеки

Python

Установка

pip install openai
# или
pip install anthropic

OpenAI клиент

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://kimrel.com/api/v1"
)

# Список доступных моделей
models = client.models.list()
for model in models.data:
    print(f"Model ID: {model.id}")

# Создать chat completion
response = client.chat.completions.create(
    model="kimi-k2-0905",
    messages=[
        {"role": "user", "content": "Привет"}
    ]
)

Anthropic клиент

from anthropic import Anthropic

client = Anthropic(
    api_key="YOUR_API_KEY",
    base_url="https://kimrel.com/api/v1"
)

response = client.messages.create(
    model="kimi-k2-0905",
    messages=[
        {"role": "user", "content": "Привет"}
    ],
    max_tokens=1024
)

Node.js

Установка

npm install openai
# или
npm install @anthropic-ai/sdk

OpenAI клиент

import OpenAI from 'openai';

const openai = new OpenAI({
  apiKey: process.env.KIMI_API_KEY,
  baseURL: 'https://kimrel.com/api/v1',
});

// Список доступных моделей
const models = await openai.models.list();
for (const model of models.data) {
  console.log(`Model ID: ${model.id}`);
}

// Создать chat completion
const response = await openai.chat.completions.create({
  model: 'kimi-k2-0905',
  messages: [{ role: 'user', content: 'Привет' }],
});

Anthropic клиент

import Anthropic from '@anthropic-ai/sdk';

const anthropic = new Anthropic({
  apiKey: process.env.KIMI_API_KEY,
  baseURL: 'https://kimrel.com/api/v1',
});

const response = await anthropic.messages.create({
  model: 'kimi-k2-0905',
  messages: [{ role: 'user', content: 'Привет' }],
  max_tokens: 1024,
});

Go

Установка

go get github.com/sashabaranov/go-openai

Пример

package main

import (
    "context"
    "fmt"
    openai "github.com/sashabaranov/go-openai"
)

func main() {
    config := openai.DefaultConfig("YOUR_API_KEY")
    config.BaseURL = "https://kimrel.com/api/v1"
    
    client := openai.NewClientWithConfig(config)
    
    resp, err := client.CreateChatCompletion(
        context.Background(),
        openai.ChatCompletionRequest{
            Model: "kimi-k2",
            Messages: []openai.ChatCompletionMessage{
                {
                    Role:    openai.ChatMessageRoleUser,
                    Content: "Привет",
                },
            },
        },
    )
    
    if err != nil {
        panic(err)
    }
    
    fmt.Println(resp.Choices[0].Message.Content)
}

REST API

Прямые HTTP запросы без клиентских библиотек:

cURL

curl -X POST https://kimrel.com/api/v1/chat/completions \
  -H "Authorization: Bearer $KIMI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2",
    "messages": [
      {"role": "user", "content": "Привет"}
    ]
  }'

Python (requests)

import requests

response = requests.post(
    "https://kimrel.com/api/v1/chat/completions",
    headers={
        "Authorization": f"Bearer {api_key}",
        "Content-Type": "application/json"
    },
    json={
        "model": "kimi-k2",
        "messages": [{"role": "user", "content": "Привет"}]
    }
)

Node.js (fetch)

const response = await fetch('https://kimrel.com/api/v1/chat/completions', {
  method: 'POST',
  headers: {
    'Authorization': `Bearer ${apiKey}`,
    'Content-Type': 'application/json',
  },
  body: JSON.stringify({
    model: 'kimi-k2-0905',
    messages: [{ role: 'user', content: 'Привет' }],
  }),
});

Биллинг

Система кредитов

Использование API биллируется через credit wallet:

  • Credits динамически списываются по input и output token usage
  • Минимальное списание: большинство моделей начинается с 1 credit за successful request
  • kimi-k2.5: минимум 2 credits за successful request
  • kimi-k2.6: минимум 3 credits за successful request
  • kimi-k2.7-code: минимум 3 credits за successful request
  • kimi-k3: минимум 3 credits за successful request
  • Финальное списание происходит после successful completion на основе фактического token usage
  • неуспешные запросы (4xx) не тарифицируются
  • серверные ошибки (5xx) не тарифицируются
  • новым пользователям начисляется 10 бесплатных кредитов при регистрации
  • бонусы по приглашениям:
    • 50 кредитов при регистрации по вашему инвайт‑коду
    • 500 кредитов после первой оплаты приглашённого пользователя

Пакеты кредитов

ПакетКредитыЦенаЗа кредитСрок
Starter500$4.99$0.0099No expiration
Standard5,000$29.99$0.00601 month
Premium20,000$59.99$0.00301 month
EnterpriseCustomContact salesCustomCustom

Отслеживание использования

Отслеживайте использование:

  1. Ответные заголовки: X-Credits-Remaining: 4523
  2. Кабинет: статистика в реальном времени /my-credits
  3. API endpoint: GET /api/user/credits

Данные использования включают:

  • всего использовано кредитов
  • остаток кредитов
  • использование по дням/часам
  • среднее количество токенов на запрос

Руководство по миграции

С OpenAI

Переход с OpenAI API требует минимальных изменений:

  1. Обновите base URL:

    # Было
    client = OpenAI(api_key="sk-...")
    
    # Стало
    client = OpenAI(
        api_key="sk-...",
        base_url="https://kimrel.com/api/v1"
    )
    
  2. Обновите название модели:

    # Было
    model="gpt-4"
    
    # Стало
    model="kimi-k2-0905"
    
  3. Других изменений не требуется — API полностью совместим

С Anthropic

Миграция с Anthropic API:

  1. Обновите base URL:

    # Было
    client = Anthropic(api_key="sk-ant-...")
    
    # Стало
    client = Anthropic(
        api_key="sk-...",
        base_url="https://kimrel.com/api/v1"
    )
    
  2. Обновите аутентификацию:

    • Сгенерируйте API ключ в Kimi K2 dashboard
    • Замените Anthropic API ключ
  3. Совместимость моделей:

    • Kimi K2 поддерживается

Журнал изменений

2025-09-05

  • Поддержка контекста 256K
  • Поддержка модели kimi-k2-0905

2025-01-30

  • Добавлена совместимость с Anthropic Messages API
  • Введена аутентификация X-API-Key