Перейти к содержимому
EN

Roo Code

Подключите Roo Code к Mixen — оплата с баланса в рублях, каталог из 105+ моделей.

Roo Code — агентное расширение для VS Code (форк Cline). Установите его из VS Code Marketplace: Extensions → поиск «Roo Code» → Install.

  1. Откройте Roo Code на боковой панели VS Code, затем настройки — иконка шестерёнки.
  2. В поле API Provider выберите OpenAI Compatible.
  3. Заполните поля подключения:
Base URL: https://api.mixen.ai/v1
API Key: ваш-api-ключ
Model: anthropic/claude-opus-5
  1. В Model Configuration можно задать Context Window, Max Output Tokens и цены Input/Output — Roo Code будет показывать расход сам; ориентир — карточка модели в каталоге.

В отличие от Cline, у Roo Code нет XML-фолбэка для инструментов: модель обязана поддерживать нативный tool calling (OpenAI tools API). Mixen поддерживает его на /v1/chat/completions, поэтому подходят модели с tool calling из каталога.

Прежде чем настраивать провайдера, ключ и баланс можно проверить минимальным генерирующим запросом:

curl https://api.mixen.ai/v1/chat/completions \
-H "Authorization: Bearer ваш-api-ключ" \
-H "Content-Type: application/json" \
-d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"ping"}],"max_tokens":5}'

200 с ответом — ключ и баланс рабочие; 401 invalid api key — ключ скопирован не целиком или это не API-ключ Mixen; 402 — на балансе нет средств.

GET /v1/models ключ не проверяет — он отвечает и без него; годится только как проверка достижимости API.

Roo Code гоняет длинные агентные циклы «прочитал → подумал → поправил», и цена входа решает больше, чем цена выхода. Цены ниже — за 1 млн токенов, вход/выход; полные таблицы с колонками кэша — в каталоге.

Задача Модель Вход / выход
Режимы Ask и Architect: вопросы, планы, ревью GLM 5.3 Flash (z-ai/glm-5.3-flash) 8,4 / 27,9 ₽
Повседневные правки в Code GLM 5.3 (z-ai/glm-5.3) 156 / 490,2 ₽
Сложные многошаговые задачи в Code GPT-5.6 Sol (openai/gpt-5.6-sol), Claude Sonnet 5 (anthropic/claude-sonnet-5) 213,9 / 1069,5 ₽

Режимы Roo Code запоминают по последней модели каждый — назначьте дешёвую на Ask/Architect и мощную на Code один раз, дальше переключение режимов будет переключать и модель автоматически.

Режим Что делает Модель
Ask вопросы по коду, только чтение z-ai/glm-5.3-flash
Architect планы и проектирование, правит только markdown z-ai/glm-5.3-flash
Code правки файлов и команды в терминале z-ai/glm-5.3, openai/gpt-5.6-sol
Debug системная диагностика сложных багов openai/gpt-5.6-sol
Orchestrator разбивает задачу на подзадачи и делегирует другим режимам openai/gpt-5.6-sol

Каждый шаг Roo Code отправляет накопленный контекст целиком — системный промпт, правила, историю, прочитанные файлы. Mixen кэширует этот повторяющийся префикс сам, включать ничего не нужно.

  • Кэшированный вход — ~10% обычной цены: у GPT-5.6 Sol вход 213,9 ₽ за 1 млн токенов, из кэша — 21,4 ₽; у GLM 5.3 Flash — 8,4 и 1,7 ₽.
  • Кэш живёт 5 минут, и каждое попадание продлевает этот срок. В непрерывной сессии кэш не истекает с первого хода до последнего.
  • Пауза свыше 5 минут — первый ход после неё по полной цене входа; это ожидаемое поведение, а не двойное списание.

Что из этого следует на практике:

  • План на дешёвой модели, правки на дорогой — и то и другое грет один и тот же кэш, потому что контекст общий.
  • Не рвите задачу паузами: те же десять ходов подряд стоят заметно меньше, чем те же десять ходов вразброс по вечеру.
  • Ответы идут настоящим стримингом — посимвольными дельтами; на цену это не влияет.

Считаем рабочий день в Code на GLM 5.3 (вход 156 ₽ за 1 млн, из кэша — 29 ₽): 30 ходов, каждый отправляет ~50 тыс. токенов контекста.

Сценарий Вход за сессию
Без кэша 1,5 млн токенов × 156 ₽ ≈ 234 ₽
С кэшем первый ход полностью, дальше префикс по 29 ₽ ≈ 68 ₽

Глубина кэш-скидки у моделей разная: у GLM 5.3 повторный вход стоит ~19% полного, у GPT-5.6 Sol — ~10% от ещё более высокой полной цены. Точная пара «полная/кэш» для каждой модели — в каталоге. Цифры ориентировочные: реальные объёмы зависят от проекта и числа открытых файлов.

Доля кэша в ответе видна в usage.prompt_tokens_details.cached_tokens. А поскольку цены в Model Configuration вы задаёте вручную, берите их оттуда же, из каталога, — тогда встроенный счётчик расхода Roo Code будет показывать правдоподобные рубли, включая кэш-скидку.

У провайдера OpenAI Compatible в настройках Roo Code есть селектор Reasoning Effort — выбранное значение уходит в наш параметр reasoning_effort. Mixen принимает off, low, medium, high, xhigh и max — какие из них доступны конкретной модели, смотрите в GET /v1/modelscapabilities.reasoning_efforts (флаг can_disable_reasoning показывает, принимает ли она off).

Помните:

  • Размышления оплачиваются как output-токены и расходуют лимит длины ответа — для длинных правок нужен запас по Max Output Tokens, иначе генерация оборвётся на середине.
  • Высокая глубина оправдана в Debug и на незнакомом коде; для простых правок хватит low/medium.
  • Режимы под тип хода. Code — правки и команды; Ask — вопросы по коду (только чтение, файлы не трогает); Architect — планы и проектирование (правит только markdown-файлы); Debug — системная диагностика; Orchestrator (Boomerang) — разбивает большую задачу на подзадачи и раздаёт их другим режимам. Переключение — выпадающим списком у поля ввода или слэш-командами /code, /ask, /architect, /debug, /orchestrator.
  • Каждому режиму — своя модель. Roo помнит последнюю модель режима и включает её при переключении; активный режим сохраняется и между сессиями. Схема экономии: Ask/Architect — GLM 5.3 Flash, Code — GLM 5.3 или GPT-5.6 Sol.
  • Правила — в .roo/rules/. Каталог .roo/rules/ в корне проекта (или один файл .roorules, если каталога нет); режимные правила — .roo/rules-code/ и т. д.; глобальные — ~/.roo/rules/. Файлы читаются рекурсивно и по алфавиту; AGENTS.md в корне подхватывается автоматически. Проектные правила перекрывают глобальные.

Типовая раскладка правил проекта:

.roo/
rules/ # правила для всех режимов
01-style.md
02-tests.md
rules-code/ # только для режима Code
hotfixes.md
rules-architect/ # только для Architect
adr-template.md
  • Инструменты — нативно. Roo работает только с OpenAI tools API, а Mixen поддерживает tools и tool_choice на /v1/chat/completions — включая многораундовые сценарии с role: 'tool'. Ограничение одно: сама модель должна уметь tool calling.
  • Ask и Architect — на GLM 5.3 Flash, Code и Debug — на GLM 5.3 или GPT-5.6 Sol; режимы помнят свои модели.
  • Разведку делайте в Ask — ходы чтения дешёвые и греют общий кэш.
  • Reasoning Effort — low/medium для типовых правок, high+ для Debug и незнакомого кода.
  • Цены в Model Configuration — из карточки модели в каталоге.
  • Смена задачи — новая сессия в нужном режиме, а не продолжение раздутой истории.
Модель ID
GPT-5.6 Sol openai/gpt-5.6-sol
Claude Opus 5 anthropic/claude-opus-5
GLM 5.3 z-ai/glm-5.3
DeepSeek V4 Pro deepseek/deepseek-v4-pro
Kimi K3 moonshotai/kimi-k3

Актуальный список — в каталоге.

  • «Invalid API Key» / 401 — ключ должен быть от Mixen (начинается с mxn-) и скопирован целиком; проверьте, что выбран провайдер OpenAI Compatible.
  • «Model Not Found» / 404 — Model ID вводится вручную и должен точно совпадать с каталогом, включая префикс провайдера.
  • Ошибки при вызове инструментов — Roo Code работает только с нативным tool calling; если модель сбоит на инструментах, смените её на другую из каталога.
  • В режиме не та модель, которую вы выбирали — режимы запоминают по модели: переключились в Ask, а там прошлая дешёвая — так и задумано. Поменяйте модель в самом режиме.
  • Первый ход после паузы дороже остальных — кэш протух за 5+ минут простоя, ход оплатил полный вход. Следующие ходы снова дешевеют.