Перейти к содержимому
EN

Cursor

Подключите Cursor к Mixen — оплата с баланса в рублях, каталог из 105+ моделей.

Cursor — IDE на базе VS Code. Скачайте установщик с cursor.com (macOS, Windows, Linux). Аккаунты OpenAI или Anthropic не нужны — все запросы чата пойдут через Mixen.

  1. Откройте Cursor Settings → Models (шестерёнка в правом верхнем углу окна).
  2. В секции OpenAI API Key вставьте ключ Mixen и включите Override OpenAI Base URL:
Base URL: https://api.mixen.ai/v1
OpenAI API Key: ваш-api-ключ
  1. Нажмите Add model и добавьте модель по её ID из каталога — например openai/gpt-5.6-sol, затем включите её чекбокс в списке.
  2. Сохраните настройки. Если в вашей версии есть кнопка Verify — она обратится к GET /v1/models и подтвердит, что адрес API доступен (сам ключ этот запрос не проверяет); в новых версиях Cursor кнопки нет, соединение проверит первый же запрос.

Ключ вида mxn-… выпускается в кабинете.

Прежде чем настраивать модели, ключ и баланс можно проверить минимальным генерирующим запросом:

curl https://api.mixen.ai/v1/chat/completions \
-H "Authorization: Bearer ваш-api-ключ" \
-H "Content-Type: application/json" \
-d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"ping"}],"max_tokens":5}'

200 с ответом — ключ и баланс рабочие; 401 invalid api key — ключ скопирован не целиком или это не API-ключ Mixen; 402 — на балансе нет средств.

GET /v1/models ключ не проверяет — он отвечает и без него; годится только как проверка достижимости API.

В IDE-агенте каждая итерация заново отправляет почти весь накопленный контекст, поэтому цена входа влияет на счёт сильнее, чем кажется на первый взгляд. Цены ниже — за 1 млн токенов, вход/выход; полные таблицы с кэш-колонками — в каталоге.

Задача Модель Вход / выход
Вопросы по коду, ревью, мелкие правки GLM 5.3 Flash (z-ai/glm-5.3-flash) 8,4 / 27,9 ₽
Многофайловые правки в знакомом коде GLM 5.3 (z-ai/glm-5.3) 156 / 490,2 ₽
Сложные агентные задачи, незнакомая кодовая база GPT-5.6 Sol (openai/gpt-5.6-sol), Claude Sonnet 5 (anthropic/claude-sonnet-5) 213,9 / 1069,5 ₽

GLM 5.3 Flash — дешёвая рабочая лошадка: обсудить структуру проекта, задать вопрос по файлу, набросать план. Флагманы GPT-5.6 Sol и Claude Sonnet 5 включайте там, где важна точность многошаговых правок и рассуждений. Полезный приём — завести в списке обе и переключаться по ходу сессии.

Три главных фильтра при выборе под агентную работу видны в карточке модели в каталоге: размер контекстного окна, допустимые reasoning_efforts и поддержка tool calling.

Каждый ход агента платит за вход заново — но Mixen кэширует повторяющийся префикс контекста (системный промпт, правила, история диалога, прочитанные файлы) автоматически. Включать что-либо в клиенте не нужно.

  • Повторный контекст — ~10% цены входа. У GPT-5.6 Sol вход стоит 213,9 ₽ за 1 млн токенов, из кэша — 21,4 ₽; у GLM 5.3 Flash — 8,4 и 1,7 ₽ соответственно.
  • Кэш живёт 5 минут со скользящим продлением: каждый следующий запрос сбрасывает таймер. Пока вы работаете без долгих пауз, кэш живёт от начала сессии до её конца.
  • Пауза больше 5 минут — первый после неё ход платит полную цену входа, дальше кэш снова прогревается. Это нормально, а не ошибка биллинга.

Отсюда простые приёмы:

  • Ходы «прочитать и объяснить» — дешёвые: контекст едет из кэша, выход короткий. Не экономьте на них, экономьте на моделях для них.
  • Серия длинных правок выгоднее, чем кажется: полный вход платится один раз в начале, дальше он приходует из кэша.
  • Планируйте сессию компактно — серия ходов подряд дешевле тех же ходов, размазанных по дню.

Ответы приходят настоящим стримингом — посимвольными дельтами, а не одним куском в конце; на цене это не сказывается.

Прикинем агентную сессию на GPT-5.6 Sol: 30 ходов, каждый отправляет около 50 тыс. токенов контекста (правила, прочитанные файлы, история).

Сценарий Вход за сессию
Без кэша 1,5 млн токенов × 213,9 ₽ ≈ 321 ₽
С кэшем первый ход полностью, дальше префикс по 21,4 ₽ ≈ 70 ₽

Разница — только во входе: output (сами правки) в обоих сценариях одинаков. Чем длиннее сессия и чем стабильнее её начало — правила, план и прочитанные файлы от хода к ходу не меняются, — тем большую долю входа забирает кэш. Цифры ориентировочные: реальные объёмы зависят от размера проекта и числа открытых файлов.

Сколько конкретно пришло из кэша, видно в ответе API — поле usage.prompt_tokens_details.cached_tokens (при стриминге — в финальном чанке, если клиент запросил usage). Cursor это поле не показывает, но при сверке счёта с кабинетом оно отвечает на вопрос «куда ушли деньги».

Наш API принимает параметр reasoning_effort: off, low, medium, high, xhigh или max — набор зависит от модели. Допустимые значения видны в GET /v1/modelscapabilities.reasoning_efforts, а флаг can_disable_reasoning показывает, принимает ли модель off.

Два нюанса:

  • Размышления тарифицируются как output-токены и съедают бюджет max_tokens — для длинных ответов нужен запас, иначе ответ обрежется.
  • В настройках custom-моделей Cursor параметр глубины не задаётся — модель работает со значением по умолчанию. Выбирайте модель под нужную глубину заранее: ориентир — карточка в каталоге.

По документации Cursor свой ключ — это про chat-модели, и с этим связаны три вещи, которые стоит знать заранее:

  • Tab-автодополнение не идёт через Mixen — оно всегда работает на встроенных моделях Cursor, независимо от настроек ключа (подробнее — в «Типичных проблемах»).
  • Запросы проходят через серверы Cursor: финальная сборка промпта выполняется на стороне Cursor. Ключ передаётся в зашифрованном виде и не сохраняется, но трафик технически не идёт из редактора напрямую в Mixen.
  • Zero Data Retention Cursor не применяется к запросам с собственным ключом — обработка данных определяется политикой провайдера, к которому обращается Cursor, то есть Mixen.
  • Свой ключ действует на chat-модели Cursor: обычный чат и агентный режим (composer) берут модель из одного списка в Cursor Settings → Models.
  • На агентный режим ставьте модель с tool calling и большим контекстом — Mixen поддерживает инструменты на всех чат-эндпоинтах, так что ограничение только в возможностях самой модели.
  • Длинную агентную задачу удобно делить между двумя моделями: дешёвая для разведки (вопросы, поиск по коду), флагман для самих правок. Переключение модели в чате — один клик, контекст сохраняется.
  • Вопросы, ревью и поиск — на GLM 5.3 Flash; правки — на флагмане. Переключение по ходу сессии — один клик.
  • Не давайте сессии остыть: окно кэша — 5 минут, каждый ход его продлевает.
  • Законченная задача — новый чат: раздутая история оплачивается на каждом ходу (пусть и по кэш-цене).
  • Reasoning-модель — только там, где нужна глубина: размышления тарифицируются как output.
  • Сверяйте ID моделей с каталогом после обновления списка.
Модель ID
GPT-5.6 Sol openai/gpt-5.6-sol
Claude Opus 5 anthropic/claude-opus-5
GLM 5.3 z-ai/glm-5.3
DeepSeek V4 Pro deepseek/deepseek-v4-pro
Kimi K3 moonshotai/kimi-k3

ID вводится вручную и должен совпадать с каталогом посимвольно, включая префикс провайдера (openai/…, anthropic/…). Актуальный список — в каталоге.

  • 401 / Invalid API Key — ключ скопирован не целиком или это не API-ключ; выпустите новый в кабинете, он начинается с mxn-.
  • Модель не отвечает или не появилась в списке — проверьте ID в каталоге: он должен совпадать посимвольно, с префиксом провайдера, и чекбокс модели должен быть включён.
  • Tab-автодополнение не идёт через Mixen — так задумано: по документации Cursor свой ключ и переопределённый base URL работают только для чата, Tab продолжает использовать встроенные модели Cursor.
  • Первый ход после перерыва заметно дороже остальных — это кэш: пауза дольше 5 минут сбрасывает его, и ход платит полную цену входа. Дальше цена снова падает.
  • Счёт растёт быстрее ожидаемого — проверьте, не работает ли reasoning-модель там, где хватает дешёвой: размышления тарифицируются как output. Для вопросов и ревью хватает GLM 5.3 Flash.