Qwen 3.8 Max
Qwen 3.8 Max (qwen/qwen3.8-max) — новый флагман Alibaba: рассуждает с управляемой глубиной, понимает изображения, контекст 1M токенов. Топ по бенчмаркам, силён в коде и математике. Каталог публикует обе кэш-ставки — чтение и запись: экономию длинных сессий с повторяющимся префиксом можно посчитать заранее.
Параметры и возможности
Заголовок раздела «Параметры и возможности»| Параметр | Значение |
|---|---|
model |
qwen/qwen3.8-max (или короткое qwen3.8-max) |
| Контекст | 1M токенов |
| Рассуждение | всегда включено; глубина управляется |
reasoning_effort |
minimal · low · medium · high · xhigh; off не поддерживается |
| Изображения на вход | да — image_url c data:-URL |
| Файлы на вход | нет — file-часть вернёт 400 |
| Чтение кэша | 28.1 ₽ за 1 млн токенов |
| Запись кэша | 280.6 ₽ за 1 млн токенов |
Глубину рассуждения задаёт reasoning_effort: пять ступеней от minimal до xhigh. Полностью выключить размышления нельзя — off каталог для модели не объявляет; минимальная ступень minimal держит расход токенов под контролем.
Примеры
Заголовок раздела «Примеры»Задача на код с управляемой глубиной
Заголовок раздела «Задача на код с управляемой глубиной»from openai import OpenAI
client = OpenAI( base_url="https://api.mixen.ai/v1", api_key="mxn-...",)
resp = client.chat.completions.create( model="qwen/qwen3.8-max", reasoning_effort="high", messages=[{ "role": "user", "content": "Отрефактори функцию: убери дублирование, сохрани поведение. <код>", }],)print(resp.choices[0].message.content)curl https://api.mixen.ai/v1/chat/completions \ -H "Authorization: Bearer $MIXEN_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen/qwen3.8-max", "reasoning_effort": "high", "messages": [{ "role": "user", "content": "Отрефактори функцию: убери дублирование, сохрани поведение. <код>" }] }'Разбор изображения
Заголовок раздела «Разбор изображения»{ "model": "qwen/qwen3.8-max", "messages": [{ "role": "user", "content": [ {"type": "text", "text": "Что не так на этом графике? Разбери аномалии."}, {"type": "image_url", "image_url": {"url": "data:image/png;base64,iVBORw0KG..."}} ] }]}Кэш контекста в /v1/chat/completions срабатывает автоматически на повторяющемся префиксе: стабильный системный промпт на длинной сессии сначала записывается за 280.6 ₽, дальше читается за 28.1 ₽ за 1 млн токенов.
За 1 млн токенов: вход 224.5 ₽ ($2.5), выход 673.4 ₽ ($7.5), чтение кэша 28.1 ₽ ($0.312), запись кэша 280.6 ₽ ($3.125). Актуальные цены — каталог.
Сильные стороны и ограничения
Заголовок раздела «Сильные стороны и ограничения»- Флагман линейки Qwen 3.8 — код, математика, бенчмарк-топовые задачи.
- Глубина рассуждения управляется:
minimalдля дешёвых прогонов,xhighдля сложного. - Понимает изображения — единственная ветка возможностей помимо текста; файлы (PDF/DOCX) на вход не принимаются.
- Контекст 1M токенов — длинные документы и целые репозитории входят целиком.
- Опубликованы обе кэш-ставки — чтение и запись: экономию длинных сессий можно посчитать заранее.
- Выключить рассуждение нельзя:
offне поддерживается; токены размышления входят в расход и съедаютmax_tokens— под длинный ответ ставьте потолок с запасом.
Все модели — в каталоге. Общий порядок работы с текстовыми моделями — гайд по чату.