Gemini 3.1 Pro
Gemini 3.1 Pro (google/gemini-3.1-pro-preview) — флагманская модель Google. Кроме текста принимает изображения, документы, видео и аудио, а глубину рассуждения регулирует пятью уровнями. Запросы идут через обычный POST /v1/chat/completions в формате OpenAI.
Параметры и возможности
Заголовок раздела «Параметры и возможности»| Возможность | Значение |
|---|---|
model |
google/gemini-3.1-pro-preview (или короткое gemini-3.1-pro-preview) |
| Изображения на вход | Да — image_url с data:-URL в последнем сообщении |
| Файлы на вход | Да — PDF, DOCX, TXT, CSV, XLSX, PPTX, до 5 на запрос |
| Видео на вход | Да — флаг capabilities.video: вложения в кабинете и боте |
| Аудио на вход | Да — флаг capabilities.audio: вложения в кабинете и боте |
| Рассуждение | reasoning_effort: low, medium, high, xhigh, max — не отключается |
| Чтение кэша контекста | 22.30 ₽ ($0.25) за 1 млн токенов |
| Запись кэша контекста | 41.80 ₽ ($0.469) за 1 млн токенов |
Рассуждение у модели не отключается (can_disable_reasoning: false): она думает на каждом запросе, и это отражено в цене. Размышления тарифицируются как выходные токены и расходуют бюджет max_tokens. В /v1 из вложений работают картинки и документы; видео- и аудио-ввод — вложения кабинета и бота.
Примеры
Заголовок раздела «Примеры»Запрос с глубиной рассуждения
Заголовок раздела «Запрос с глубиной рассуждения»from openai import OpenAI
client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
resp = client.chat.completions.create( model="google/gemini-3.1-pro-preview", messages=[{"role": "user", "content": "Сравни два тарифных плана и найди скрытые противоречия"}], reasoning_effort="high",)print(resp.choices[0].message.content)curl https://api.mixen.ai/v1/chat/completions \ -H "Authorization: Bearer $MIXEN_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "google/gemini-3.1-pro-preview", "messages": [{"role": "user", "content": "Сравни два тарифных плана и найди скрытые противоречия"}], "reasoning_effort": "high" }'Стрим на Python
Заголовок раздела «Стрим на Python»stream = client.chat.completions.create( model="google/gemini-3.1-pro-preview", messages=[{"role": "user", "content": "Разбери контракт по пунктам: риски, сроки, штрафы"}], stream=True, stream_options={"include_usage": True},)for chunk in stream: if chunk.choices and chunk.choices[0].delta.content: print(chunk.choices[0].delta.content, end="", flush=True)За 1 млн токенов: вход — 222.80 ₽ ($2.50), выход — 1336.90 ₽ ($15). Кэш контекста: чтение — 22.30 ₽ ($0.25), запись — 41.80 ₽ ($0.469). Витринные цены обновляются вслед за курсом — актуальные значения берите в каталоге.
Сильные стороны и ограничения
Заголовок раздела «Сильные стороны и ограничения»- Четыре вида ввода в одной модели: изображения, документы, видео и аудио — по флагам каталога.
- Пять уровней глубины рассуждения, включая
xhighиmax, — от быстрых ответов до многошагового анализа. - Кэш выгоднее, чем у большинства флагманов: запись 41.80 ₽ дешевле полного входа 222.80 ₽, чтение — примерно десятая часть.
- Рассуждение не отключается — минимальная глубина
low, на простых вопросах модель всё равно думает. - Выход 1336.90 ₽ за 1 млн токенов — вшестеро дороже входа; длинные ответы считаются по полной.
- Ключ модели содержит суффикс
-preview— передавайте его точно как в каталоге.
Все модели — в каталоге. Общий порядок работы с текстом — гайд по чату.