Перейти к содержимому
EN

Qwen 3.8 Max

Qwen 3.8 Max (qwen/qwen3.8-max) — новый флагман Alibaba: рассуждает с управляемой глубиной, понимает изображения, контекст 1M токенов. Топ по бенчмаркам, силён в коде и математике. Каталог публикует обе кэш-ставки — чтение и запись: экономию длинных сессий с повторяющимся префиксом можно посчитать заранее.

Параметр Значение
model qwen/qwen3.8-max (или короткое qwen3.8-max)
Контекст 1M токенов
Рассуждение всегда включено; глубина управляется
reasoning_effort minimal · low · medium · high · xhigh; off не поддерживается
Изображения на вход да — image_url c data:-URL
Файлы на вход нет — file-часть вернёт 400
Чтение кэша 28.1 ₽ за 1 млн токенов
Запись кэша 280.6 ₽ за 1 млн токенов

Глубину рассуждения задаёт reasoning_effort: пять ступеней от minimal до xhigh. Полностью выключить размышления нельзя — off каталог для модели не объявляет; минимальная ступень minimal держит расход токенов под контролем.

from openai import OpenAI
client = OpenAI(
base_url="https://api.mixen.ai/v1",
api_key="mxn-...",
)
resp = client.chat.completions.create(
model="qwen/qwen3.8-max",
reasoning_effort="high",
messages=[{
"role": "user",
"content": "Отрефактори функцию: убери дублирование, сохрани поведение. <код>",
}],
)
print(resp.choices[0].message.content)
{
"model": "qwen/qwen3.8-max",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "Что не так на этом графике? Разбери аномалии."},
{"type": "image_url", "image_url": {"url": "data:image/png;base64,iVBORw0KG..."}}
]
}]
}

Кэш контекста в /v1/chat/completions срабатывает автоматически на повторяющемся префиксе: стабильный системный промпт на длинной сессии сначала записывается за 280.6 ₽, дальше читается за 28.1 ₽ за 1 млн токенов.

За 1 млн токенов: вход 224.5 ₽ ($2.5), выход 673.4 ₽ ($7.5), чтение кэша 28.1 ₽ ($0.312), запись кэша 280.6 ₽ ($3.125). Актуальные цены — каталог.

  • Флагман линейки Qwen 3.8 — код, математика, бенчмарк-топовые задачи.
  • Глубина рассуждения управляется: minimal для дешёвых прогонов, xhigh для сложного.
  • Понимает изображения — единственная ветка возможностей помимо текста; файлы (PDF/DOCX) на вход не принимаются.
  • Контекст 1M токенов — длинные документы и целые репозитории входят целиком.
  • Опубликованы обе кэш-ставки — чтение и запись: экономию длинных сессий можно посчитать заранее.
  • Выключить рассуждение нельзя: off не поддерживается; токены размышления входят в расход и съедают max_tokens — под длинный ответ ставьте потолок с запасом.

Все модели — в каталоге. Общий порядок работы с текстовыми моделями — гайд по чату.