Kilo Code
Подключите Kilo Code к Mixen — оплата с баланса в рублях, каталог из 105+ моделей.
Установка
Заголовок раздела «Установка»- VS Code — Extensions (
Ctrl+Shift+X/Cmd+Shift+X), найдите «Kilo Code» и нажмите Install. - JetBrains — Settings → Plugins → вкладка Marketplace, найдите «Kilo Code» и установите.
У Kilo Code есть и CLI; все клиенты читают и пишут общий конфиг kilo.jsonc — провайдер, добавленный в одном, доступен в остальных. Детали — в официальной документации.
Конфигурация
Заголовок раздела «Конфигурация»- Панель Kilo Code → Settings (шестерёнка) → вкладка Providers.
- Прокрутите список провайдеров вниз и нажмите Custom provider.
- Заполните диалог:
- Provider ID —
mixen - Display name —
Mixen - Provider API — OpenAI Compatible
- Base URL —
https://api.mixen.ai/v1 - API key — ваш ключ
mxn-… - Models — Kilo сам подтянет список из
/v1/models: выбирайте модели поиском (поддерживается fuzzy-поиск) или введите ID вручную
- Provider ID —
- Нажмите Submit — выбранные модели появятся в переключателе моделей.
Если автозагрузка не сработала, введите ID модели вручную из каталога — например, openai/gpt-5.6-sol.
Ключевые моменты:
- OpenAI Compatible — протокол Chat Completions: Kilo будет обращаться к
/v1/chat/completions. - Тонкие настройки модели (лимиты токенов, tool calling, варианты) правятся в файле
kilo.jsonc. - В JetBrains плагин использует тот же общий
kilo.jsonc— провайдер и модели из VS Code подтянутся автоматически.
Проверка подключения
Заголовок раздела «Проверка подключения»Прежде чем настраивать провайдера, ключ и баланс можно проверить минимальным генерирующим запросом:
curl https://api.mixen.ai/v1/chat/completions \ -H "Authorization: Bearer ваш-api-ключ" \ -H "Content-Type: application/json" \ -d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"ping"}],"max_tokens":5}'200 с ответом — ключ и баланс рабочие; 401 invalid api key — ключ скопирован не целиком или это не API-ключ Mixen; 402 — на балансе нет средств.
GET /v1/models ключ не проверяет — он отвечает и без него; годится только как проверка достижимости API.
Выбор модели под задачу
Заголовок раздела «Выбор модели под задачу»Kilo Code держит отдельную модель для каждого агента, поэтому связка «дешёвый на планирование, мощный на правки» настраивается один раз. Цены — за 1 млн токенов, вход/выход; полные таблицы с кэш-колонками — в каталоге.
| Задача | Модель | Вход / выход |
|---|---|---|
| Разведка: вопросы по коду, поиск, планирование | GLM 5.3 Flash (z-ai/glm-5.3-flash) |
8,4 / 27,9 ₽ |
| Правки в знакомом коде, типовые задачи | GLM 5.3 (z-ai/glm-5.3) |
156 / 490,2 ₽ |
| Многошаговые агентные задачи, рефакторинг | GPT-5.6 Sol (openai/gpt-5.6-sol), Claude Sonnet 5 (anthropic/claude-sonnet-5) |
213,9 / 1069,5 ₽ |
GLM 5.3 Flash стоит как «бесплатная» модель, но держит агентный протокол — на ней удобно оставить Ask и Plan, а Code посадить на флагман.
| Агент | Задача | Модель |
|---|---|---|
| Plan | планирование и архитектурные решения | z-ai/glm-5.3-flash |
| Ask | вопросы по коду | z-ai/glm-5.3-flash |
| Code | правки файлов и команды | z-ai/glm-5.3, openai/gpt-5.6-sol |
| Debug | диагностика багов | openai/gpt-5.6-sol |
| Explore, General | исследование кодовой базы, общие задачи | z-ai/glm-5.3-flash |
Экономия на сессиях
Заголовок раздела «Экономия на сессиях»Агентные сессии Kilo отправляют с каждым ходом весь накопленный контекст — правила, историю, прочитанные файлы. Mixen кэширует повторяющийся префикс автоматически, включать ничего не нужно.
- Повторный контекст — ~10% цены входа: у GPT-5.6 Sol вход 213,9 ₽ за 1 млн токенов, из кэша — 21,4 ₽; у GLM 5.3 Flash — 8,4 и 1,7 ₽.
- Кэш живёт 5 минут со скользящим продлением — каждый запрос внутри окна продлевает его. Непрерывная сессия держит кэш живым от начала до конца.
- Перерыв больше 5 минут — первый ход после него платит полный вход. Один дорогой ход после паузы — норма, а не ошибка.
Приёмы:
- Планирование и чтение — дешёвые ходы (вход из кэша, короткий выход); делайте их смело и побольше, экономия — на модели, а не на количестве ходов.
- Серия правок подряд дешевле тех же правок с перерывами на кофе: кэш не успевает протухнуть.
- Стриминг посимвольный — текст появляется по мере генерации; на цене не сказывается.
Сколько стоит типичная сессия
Заголовок раздела «Сколько стоит типичная сессия»Считаем разведывательную сессию на GLM 5.3 Flash (вход 8,4 ₽ за 1 млн, из кэша — 1,7 ₽): 25 ходов по ~40 тыс. токенов контекста.
| Сценарий | Вход за сессию |
|---|---|
| Без кэша | 1 млн токенов × 8,4 ₽ ≈ 8,4 ₽ |
| С кэшем | первый ход полностью, дальше префикс по 1,7 ₽ ≈ 2,6 ₽ |
Нюанс: у Flash кэш-скидка мельче, чем у флагманов — повторный вход стоит ~20% полного (у GPT-5.6 Sol — ~10%). Но абсолютные цифры настолько малы, что долгая разведка на Flash стоит копейки в обоих случаях; а прогретый на ней кэш продолжает работать, когда вы переключаетесь на дорогую модель в Code — контекст общий. Цифры ориентировочные: реальные объёмы зависят от проекта.
Долю кэша в ответе показывает usage.prompt_tokens_details.cached_tokens — интерфейс Kilo это поле не выводит, но при сверке счёта с кабинетом оно объясняет, почему ход стоил дешевле полного входа.
Глубина рассуждений
Заголовок раздела «Глубина рассуждений»Наш API принимает параметр reasoning_effort: off, low, medium, high, xhigh или max — набор зависит от модели. Допустимые значения видны в GET /v1/models → capabilities.reasoning_efforts; флаг can_disable_reasoning показывает, принимает ли модель off.
- Размышления тарифицируются как output-токены и расходуют лимит длины ответа — на длинных задачах нужен запас по max tokens.
- Если в настройках агента или модели глубина не задаётся, модель работает со значением по умолчанию — сверяйтесь с карточкой в каталоге.
Советы по агентной работе
Заголовок раздела «Советы по агентной работе»- Встроенные агенты. Из коробки доступны Code (правки), Plan (планирование), Ask (вопросы), Debug (диагностика), Explore и General. Пикер запоминает выбранную модель для каждого агента отдельно — настройте один раз: Plan и Ask на GLM 5.3 Flash, Code на GPT-5.6 Sol.
- Свои агенты. Кастомные режимы создаются в Settings → Agent Behaviour → Agents, markdown-файлами
.kilo/agents/*.mdс YAML-фронтматтером или ключомagentвkilo.jsonc. Свойствоmode: subagentпрячет агента из пикера — его смогут вызывать только другие агенты;primaryпоказывает в списке. - Правила. Список файлов и глобов задаётся ключом
instructionsвkilo.jsoncпроекта — например,".kilo/rules/*.md"; глобальные правила — в~/.config/kilo/kilo.jsonc. Формат — markdown (рекомендован) или plain text. Проектные инструкции приоритетнее глобальных.
Минимальный пример kilo.jsonc проекта:
{ // подключаем все правила проекта одной строкой "instructions": [ ".kilo/rules/*.md" ]}- Orchestrator устарел. По документации Kilo режим Orchestrator задепрекейтен: его сценарии закрывают агенты с полным доступом к инструментам (Code, Plan) — делегируйте им напрямую.
- Инструменты. Все чат-эндпоинты Mixen поддерживают
toolsиtool_choice; для агентной работы выбирайте модели с tool calling и большим контекстом.
Чек-лист экономной сессии
Заголовок раздела «Чек-лист экономной сессии»- Plan, Ask и Explore — на GLM 5.3 Flash; Code и Debug — на GLM 5.3 или GPT-5.6 Sol.
- Модель назначается каждому агенту отдельно — проверьте, что дешёвая не осталась на Code с прошлой недели.
- Разведка и планирование греют общий кэш — не жалейте на них ходов.
- Смена задачи — новый чат: старая история оплачивается на каждом ходу.
- ID моделей после пополнения списка — сверить с каталогом.
Полезное в документации
Заголовок раздела «Полезное в документации»- Custom Modes / агенты — встроенные и свои агенты, модель на каждого.
- Custom Rules — ключ
instructionsвkilo.jsonc. - Установка — VS Code, JetBrains и CLI.
- Каталог Mixen — ID моделей, цены и кэш-колонки.
Рекомендуемые модели
Заголовок раздела «Рекомендуемые модели»| Модель | ID |
|---|---|
| GPT-5.6 Sol | openai/gpt-5.6-sol |
| Claude Opus 5 | anthropic/claude-opus-5 |
| GLM 5.3 | z-ai/glm-5.3 |
| DeepSeek V4 Pro | deepseek/deepseek-v4-pro |
| Kimi K3 | moonshotai/kimi-k3 |
Актуальный список — в каталоге.
Типичные проблемы
Заголовок раздела «Типичные проблемы»- 401 / invalid API key — перепроверьте ключ
mxn-…в поле API key провайдера. - «Model Not Found» — модель не добавлена провайдеру или ID введён с опечаткой; сверьтесь с каталогом.
- Каталог моделей не загружается / ошибки соединения — проверьте, что Base URL указан верно (
https://api.mixen.ai/v1) и API доступен из сети; модели можно ввести и вручную. - Правила не применяются — проверьте пути в
instructions(ключ вkilo.jsonc, не в UI) и перезапустите чат-сессию: изменения подхватываются новой сессией. - У агента не та модель — пикер помнит выбор по каждому агенту отдельно; смените модель, находясь именно в этом агенте.