Перейти к содержимому
EN

Kilo Code

Подключите Kilo Code к Mixen — оплата с баланса в рублях, каталог из 105+ моделей.

  • VS Code — Extensions (Ctrl+Shift+X / Cmd+Shift+X), найдите «Kilo Code» и нажмите Install.
  • JetBrains — Settings → Plugins → вкладка Marketplace, найдите «Kilo Code» и установите.

У Kilo Code есть и CLI; все клиенты читают и пишут общий конфиг kilo.jsonc — провайдер, добавленный в одном, доступен в остальных. Детали — в официальной документации.

  1. Панель Kilo Code → Settings (шестерёнка) → вкладка Providers.
  2. Прокрутите список провайдеров вниз и нажмите Custom provider.
  3. Заполните диалог:
    • Provider IDmixen
    • Display nameMixen
    • Provider APIOpenAI Compatible
    • Base URLhttps://api.mixen.ai/v1
    • API key — ваш ключ mxn-…
    • Models — Kilo сам подтянет список из /v1/models: выбирайте модели поиском (поддерживается fuzzy-поиск) или введите ID вручную
  4. Нажмите Submit — выбранные модели появятся в переключателе моделей.

Если автозагрузка не сработала, введите ID модели вручную из каталога — например, openai/gpt-5.6-sol.

Ключевые моменты:

  • OpenAI Compatible — протокол Chat Completions: Kilo будет обращаться к /v1/chat/completions.
  • Тонкие настройки модели (лимиты токенов, tool calling, варианты) правятся в файле kilo.jsonc.
  • В JetBrains плагин использует тот же общий kilo.jsonc — провайдер и модели из VS Code подтянутся автоматически.

Прежде чем настраивать провайдера, ключ и баланс можно проверить минимальным генерирующим запросом:

curl https://api.mixen.ai/v1/chat/completions \
-H "Authorization: Bearer ваш-api-ключ" \
-H "Content-Type: application/json" \
-d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"ping"}],"max_tokens":5}'

200 с ответом — ключ и баланс рабочие; 401 invalid api key — ключ скопирован не целиком или это не API-ключ Mixen; 402 — на балансе нет средств.

GET /v1/models ключ не проверяет — он отвечает и без него; годится только как проверка достижимости API.

Kilo Code держит отдельную модель для каждого агента, поэтому связка «дешёвый на планирование, мощный на правки» настраивается один раз. Цены — за 1 млн токенов, вход/выход; полные таблицы с кэш-колонками — в каталоге.

Задача Модель Вход / выход
Разведка: вопросы по коду, поиск, планирование GLM 5.3 Flash (z-ai/glm-5.3-flash) 8,4 / 27,9 ₽
Правки в знакомом коде, типовые задачи GLM 5.3 (z-ai/glm-5.3) 156 / 490,2 ₽
Многошаговые агентные задачи, рефакторинг GPT-5.6 Sol (openai/gpt-5.6-sol), Claude Sonnet 5 (anthropic/claude-sonnet-5) 213,9 / 1069,5 ₽

GLM 5.3 Flash стоит как «бесплатная» модель, но держит агентный протокол — на ней удобно оставить Ask и Plan, а Code посадить на флагман.

Агент Задача Модель
Plan планирование и архитектурные решения z-ai/glm-5.3-flash
Ask вопросы по коду z-ai/glm-5.3-flash
Code правки файлов и команды z-ai/glm-5.3, openai/gpt-5.6-sol
Debug диагностика багов openai/gpt-5.6-sol
Explore, General исследование кодовой базы, общие задачи z-ai/glm-5.3-flash

Агентные сессии Kilo отправляют с каждым ходом весь накопленный контекст — правила, историю, прочитанные файлы. Mixen кэширует повторяющийся префикс автоматически, включать ничего не нужно.

  • Повторный контекст — ~10% цены входа: у GPT-5.6 Sol вход 213,9 ₽ за 1 млн токенов, из кэша — 21,4 ₽; у GLM 5.3 Flash — 8,4 и 1,7 ₽.
  • Кэш живёт 5 минут со скользящим продлением — каждый запрос внутри окна продлевает его. Непрерывная сессия держит кэш живым от начала до конца.
  • Перерыв больше 5 минут — первый ход после него платит полный вход. Один дорогой ход после паузы — норма, а не ошибка.

Приёмы:

  • Планирование и чтение — дешёвые ходы (вход из кэша, короткий выход); делайте их смело и побольше, экономия — на модели, а не на количестве ходов.
  • Серия правок подряд дешевле тех же правок с перерывами на кофе: кэш не успевает протухнуть.
  • Стриминг посимвольный — текст появляется по мере генерации; на цене не сказывается.

Считаем разведывательную сессию на GLM 5.3 Flash (вход 8,4 ₽ за 1 млн, из кэша — 1,7 ₽): 25 ходов по ~40 тыс. токенов контекста.

Сценарий Вход за сессию
Без кэша 1 млн токенов × 8,4 ₽ ≈ 8,4 ₽
С кэшем первый ход полностью, дальше префикс по 1,7 ₽ ≈ 2,6 ₽

Нюанс: у Flash кэш-скидка мельче, чем у флагманов — повторный вход стоит ~20% полного (у GPT-5.6 Sol — ~10%). Но абсолютные цифры настолько малы, что долгая разведка на Flash стоит копейки в обоих случаях; а прогретый на ней кэш продолжает работать, когда вы переключаетесь на дорогую модель в Code — контекст общий. Цифры ориентировочные: реальные объёмы зависят от проекта.

Долю кэша в ответе показывает usage.prompt_tokens_details.cached_tokens — интерфейс Kilo это поле не выводит, но при сверке счёта с кабинетом оно объясняет, почему ход стоил дешевле полного входа.

Наш API принимает параметр reasoning_effort: off, low, medium, high, xhigh или max — набор зависит от модели. Допустимые значения видны в GET /v1/modelscapabilities.reasoning_efforts; флаг can_disable_reasoning показывает, принимает ли модель off.

  • Размышления тарифицируются как output-токены и расходуют лимит длины ответа — на длинных задачах нужен запас по max tokens.
  • Если в настройках агента или модели глубина не задаётся, модель работает со значением по умолчанию — сверяйтесь с карточкой в каталоге.
  • Встроенные агенты. Из коробки доступны Code (правки), Plan (планирование), Ask (вопросы), Debug (диагностика), Explore и General. Пикер запоминает выбранную модель для каждого агента отдельно — настройте один раз: Plan и Ask на GLM 5.3 Flash, Code на GPT-5.6 Sol.
  • Свои агенты. Кастомные режимы создаются в Settings → Agent Behaviour → Agents, markdown-файлами .kilo/agents/*.md с YAML-фронтматтером или ключом agent в kilo.jsonc. Свойство mode: subagent прячет агента из пикера — его смогут вызывать только другие агенты; primary показывает в списке.
  • Правила. Список файлов и глобов задаётся ключом instructions в kilo.jsonc проекта — например, ".kilo/rules/*.md"; глобальные правила — в ~/.config/kilo/kilo.jsonc. Формат — markdown (рекомендован) или plain text. Проектные инструкции приоритетнее глобальных.

Минимальный пример kilo.jsonc проекта:

{
// подключаем все правила проекта одной строкой
"instructions": [
".kilo/rules/*.md"
]
}
  • Orchestrator устарел. По документации Kilo режим Orchestrator задепрекейтен: его сценарии закрывают агенты с полным доступом к инструментам (Code, Plan) — делегируйте им напрямую.
  • Инструменты. Все чат-эндпоинты Mixen поддерживают tools и tool_choice; для агентной работы выбирайте модели с tool calling и большим контекстом.
  • Plan, Ask и Explore — на GLM 5.3 Flash; Code и Debug — на GLM 5.3 или GPT-5.6 Sol.
  • Модель назначается каждому агенту отдельно — проверьте, что дешёвая не осталась на Code с прошлой недели.
  • Разведка и планирование греют общий кэш — не жалейте на них ходов.
  • Смена задачи — новый чат: старая история оплачивается на каждом ходу.
  • ID моделей после пополнения списка — сверить с каталогом.
Модель ID
GPT-5.6 Sol openai/gpt-5.6-sol
Claude Opus 5 anthropic/claude-opus-5
GLM 5.3 z-ai/glm-5.3
DeepSeek V4 Pro deepseek/deepseek-v4-pro
Kimi K3 moonshotai/kimi-k3

Актуальный список — в каталоге.

  • 401 / invalid API key — перепроверьте ключ mxn-… в поле API key провайдера.
  • «Model Not Found» — модель не добавлена провайдеру или ID введён с опечаткой; сверьтесь с каталогом.
  • Каталог моделей не загружается / ошибки соединения — проверьте, что Base URL указан верно (https://api.mixen.ai/v1) и API доступен из сети; модели можно ввести и вручную.
  • Правила не применяются — проверьте пути в instructions (ключ в kilo.jsonc, не в UI) и перезапустите чат-сессию: изменения подхватываются новой сессией.
  • У агента не та модель — пикер помнит выбор по каждому агенту отдельно; смените модель, находясь именно в этом агенте.