Roo Code
Подключите Roo Code к Mixen — оплата с баланса в рублях, каталог из 105+ моделей.
Установка
Заголовок раздела «Установка»Roo Code — агентное расширение для VS Code (форк Cline). Установите его из VS Code Marketplace: Extensions → поиск «Roo Code» → Install.
Конфигурация
Заголовок раздела «Конфигурация»- Откройте Roo Code на боковой панели VS Code, затем настройки — иконка шестерёнки.
- В поле API Provider выберите OpenAI Compatible.
- Заполните поля подключения:
Base URL: https://api.mixen.ai/v1API Key: ваш-api-ключModel: anthropic/claude-opus-5- В Model Configuration можно задать Context Window, Max Output Tokens и цены Input/Output — Roo Code будет показывать расход сам; ориентир — карточка модели в каталоге.
В отличие от Cline, у Roo Code нет XML-фолбэка для инструментов: модель обязана поддерживать нативный tool calling (OpenAI tools API). Mixen поддерживает его на /v1/chat/completions, поэтому подходят модели с tool calling из каталога.
Проверка подключения
Заголовок раздела «Проверка подключения»Прежде чем настраивать провайдера, ключ и баланс можно проверить минимальным генерирующим запросом:
curl https://api.mixen.ai/v1/chat/completions \ -H "Authorization: Bearer ваш-api-ключ" \ -H "Content-Type: application/json" \ -d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"ping"}],"max_tokens":5}'200 с ответом — ключ и баланс рабочие; 401 invalid api key — ключ скопирован не целиком или это не API-ключ Mixen; 402 — на балансе нет средств.
GET /v1/models ключ не проверяет — он отвечает и без него; годится только как проверка достижимости API.
Выбор модели под задачу
Заголовок раздела «Выбор модели под задачу»Roo Code гоняет длинные агентные циклы «прочитал → подумал → поправил», и цена входа решает больше, чем цена выхода. Цены ниже — за 1 млн токенов, вход/выход; полные таблицы с колонками кэша — в каталоге.
| Задача | Модель | Вход / выход |
|---|---|---|
| Режимы Ask и Architect: вопросы, планы, ревью | GLM 5.3 Flash (z-ai/glm-5.3-flash) |
8,4 / 27,9 ₽ |
| Повседневные правки в Code | GLM 5.3 (z-ai/glm-5.3) |
156 / 490,2 ₽ |
| Сложные многошаговые задачи в Code | GPT-5.6 Sol (openai/gpt-5.6-sol), Claude Sonnet 5 (anthropic/claude-sonnet-5) |
213,9 / 1069,5 ₽ |
Режимы Roo Code запоминают по последней модели каждый — назначьте дешёвую на Ask/Architect и мощную на Code один раз, дальше переключение режимов будет переключать и модель автоматически.
| Режим | Что делает | Модель |
|---|---|---|
| Ask | вопросы по коду, только чтение | z-ai/glm-5.3-flash |
| Architect | планы и проектирование, правит только markdown | z-ai/glm-5.3-flash |
| Code | правки файлов и команды в терминале | z-ai/glm-5.3, openai/gpt-5.6-sol |
| Debug | системная диагностика сложных багов | openai/gpt-5.6-sol |
| Orchestrator | разбивает задачу на подзадачи и делегирует другим режимам | openai/gpt-5.6-sol |
Экономия на сессиях
Заголовок раздела «Экономия на сессиях»Каждый шаг Roo Code отправляет накопленный контекст целиком — системный промпт, правила, историю, прочитанные файлы. Mixen кэширует этот повторяющийся префикс сам, включать ничего не нужно.
- Кэшированный вход — ~10% обычной цены: у GPT-5.6 Sol вход 213,9 ₽ за 1 млн токенов, из кэша — 21,4 ₽; у GLM 5.3 Flash — 8,4 и 1,7 ₽.
- Кэш живёт 5 минут, и каждое попадание продлевает этот срок. В непрерывной сессии кэш не истекает с первого хода до последнего.
- Пауза свыше 5 минут — первый ход после неё по полной цене входа; это ожидаемое поведение, а не двойное списание.
Что из этого следует на практике:
- План на дешёвой модели, правки на дорогой — и то и другое грет один и тот же кэш, потому что контекст общий.
- Не рвите задачу паузами: те же десять ходов подряд стоят заметно меньше, чем те же десять ходов вразброс по вечеру.
- Ответы идут настоящим стримингом — посимвольными дельтами; на цену это не влияет.
Сколько стоит типичная сессия
Заголовок раздела «Сколько стоит типичная сессия»Считаем рабочий день в Code на GLM 5.3 (вход 156 ₽ за 1 млн, из кэша — 29 ₽): 30 ходов, каждый отправляет ~50 тыс. токенов контекста.
| Сценарий | Вход за сессию |
|---|---|
| Без кэша | 1,5 млн токенов × 156 ₽ ≈ 234 ₽ |
| С кэшем | первый ход полностью, дальше префикс по 29 ₽ ≈ 68 ₽ |
Глубина кэш-скидки у моделей разная: у GLM 5.3 повторный вход стоит ~19% полного, у GPT-5.6 Sol — ~10% от ещё более высокой полной цены. Точная пара «полная/кэш» для каждой модели — в каталоге. Цифры ориентировочные: реальные объёмы зависят от проекта и числа открытых файлов.
Доля кэша в ответе видна в usage.prompt_tokens_details.cached_tokens. А поскольку цены в Model Configuration вы задаёте вручную, берите их оттуда же, из каталога, — тогда встроенный счётчик расхода Roo Code будет показывать правдоподобные рубли, включая кэш-скидку.
Глубина рассуждений
Заголовок раздела «Глубина рассуждений»У провайдера OpenAI Compatible в настройках Roo Code есть селектор Reasoning Effort — выбранное значение уходит в наш параметр reasoning_effort. Mixen принимает off, low, medium, high, xhigh и max — какие из них доступны конкретной модели, смотрите в GET /v1/models → capabilities.reasoning_efforts (флаг can_disable_reasoning показывает, принимает ли она off).
Помните:
- Размышления оплачиваются как output-токены и расходуют лимит длины ответа — для длинных правок нужен запас по Max Output Tokens, иначе генерация оборвётся на середине.
- Высокая глубина оправдана в Debug и на незнакомом коде; для простых правок хватит
low/medium.
Советы по агентной работе
Заголовок раздела «Советы по агентной работе»- Режимы под тип хода. Code — правки и команды; Ask — вопросы по коду (только чтение, файлы не трогает); Architect — планы и проектирование (правит только markdown-файлы); Debug — системная диагностика; Orchestrator (Boomerang) — разбивает большую задачу на подзадачи и раздаёт их другим режимам. Переключение — выпадающим списком у поля ввода или слэш-командами
/code,/ask,/architect,/debug,/orchestrator. - Каждому режиму — своя модель. Roo помнит последнюю модель режима и включает её при переключении; активный режим сохраняется и между сессиями. Схема экономии: Ask/Architect — GLM 5.3 Flash, Code — GLM 5.3 или GPT-5.6 Sol.
- Правила — в
.roo/rules/. Каталог.roo/rules/в корне проекта (или один файл.roorules, если каталога нет); режимные правила —.roo/rules-code/и т. д.; глобальные —~/.roo/rules/. Файлы читаются рекурсивно и по алфавиту;AGENTS.mdв корне подхватывается автоматически. Проектные правила перекрывают глобальные.
Типовая раскладка правил проекта:
.roo/ rules/ # правила для всех режимов 01-style.md 02-tests.md rules-code/ # только для режима Code hotfixes.md rules-architect/ # только для Architect adr-template.md- Инструменты — нативно. Roo работает только с OpenAI tools API, а Mixen поддерживает
toolsиtool_choiceна/v1/chat/completions— включая многораундовые сценарии сrole: 'tool'. Ограничение одно: сама модель должна уметь tool calling.
Чек-лист экономной сессии
Заголовок раздела «Чек-лист экономной сессии»- Ask и Architect — на GLM 5.3 Flash, Code и Debug — на GLM 5.3 или GPT-5.6 Sol; режимы помнят свои модели.
- Разведку делайте в Ask — ходы чтения дешёвые и греют общий кэш.
- Reasoning Effort —
low/mediumдля типовых правок,high+ для Debug и незнакомого кода. - Цены в Model Configuration — из карточки модели в каталоге.
- Смена задачи — новая сессия в нужном режиме, а не продолжение раздутой истории.
Полезное в документации
Заголовок раздела «Полезное в документации»- Using Modes — режимы, привязка моделей, слэш-команды.
- Custom Instructions —
.roo/rules/и режимные правила. - Каталог Mixen — ID моделей, цены и кэш-колонки.
Рекомендуемые модели
Заголовок раздела «Рекомендуемые модели»| Модель | ID |
|---|---|
| GPT-5.6 Sol | openai/gpt-5.6-sol |
| Claude Opus 5 | anthropic/claude-opus-5 |
| GLM 5.3 | z-ai/glm-5.3 |
| DeepSeek V4 Pro | deepseek/deepseek-v4-pro |
| Kimi K3 | moonshotai/kimi-k3 |
Актуальный список — в каталоге.
Типичные проблемы
Заголовок раздела «Типичные проблемы»- «Invalid API Key» / 401 — ключ должен быть от Mixen (начинается с
mxn-) и скопирован целиком; проверьте, что выбран провайдер OpenAI Compatible. - «Model Not Found» / 404 — Model ID вводится вручную и должен точно совпадать с каталогом, включая префикс провайдера.
- Ошибки при вызове инструментов — Roo Code работает только с нативным tool calling; если модель сбоит на инструментах, смените её на другую из каталога.
- В режиме не та модель, которую вы выбирали — режимы запоминают по модели: переключились в Ask, а там прошлая дешёвая — так и задумано. Поменяйте модель в самом режиме.
- Первый ход после паузы дороже остальных — кэш протух за 5+ минут простоя, ход оплатил полный вход. Следующие ходы снова дешевеют.