Перейти к содержимому
EN

Gemini 3.1 Pro

Gemini 3.1 Pro (google/gemini-3.1-pro-preview) — флагманская модель Google. Кроме текста принимает изображения, документы, видео и аудио, а глубину рассуждения регулирует пятью уровнями. Запросы идут через обычный POST /v1/chat/completions в формате OpenAI.

Возможность Значение
model google/gemini-3.1-pro-preview (или короткое gemini-3.1-pro-preview)
Изображения на вход Да — image_url с data:-URL в последнем сообщении
Файлы на вход Да — PDF, DOCX, TXT, CSV, XLSX, PPTX, до 5 на запрос
Видео на вход Да — флаг capabilities.video: вложения в кабинете и боте
Аудио на вход Да — флаг capabilities.audio: вложения в кабинете и боте
Рассуждение reasoning_effort: low, medium, high, xhigh, max — не отключается
Чтение кэша контекста 22.30 ₽ ($0.25) за 1 млн токенов
Запись кэша контекста 41.80 ₽ ($0.469) за 1 млн токенов

Рассуждение у модели не отключается (can_disable_reasoning: false): она думает на каждом запросе, и это отражено в цене. Размышления тарифицируются как выходные токены и расходуют бюджет max_tokens. В /v1 из вложений работают картинки и документы; видео- и аудио-ввод — вложения кабинета и бота.

from openai import OpenAI
client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
resp = client.chat.completions.create(
model="google/gemini-3.1-pro-preview",
messages=[{"role": "user", "content": "Сравни два тарифных плана и найди скрытые противоречия"}],
reasoning_effort="high",
)
print(resp.choices[0].message.content)
stream = client.chat.completions.create(
model="google/gemini-3.1-pro-preview",
messages=[{"role": "user", "content": "Разбери контракт по пунктам: риски, сроки, штрафы"}],
stream=True,
stream_options={"include_usage": True},
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)

За 1 млн токенов: вход — 222.80 ₽ ($2.50), выход — 1336.90 ₽ ($15). Кэш контекста: чтение — 22.30 ₽ ($0.25), запись — 41.80 ₽ ($0.469). Витринные цены обновляются вслед за курсом — актуальные значения берите в каталоге.

  • Четыре вида ввода в одной модели: изображения, документы, видео и аудио — по флагам каталога.
  • Пять уровней глубины рассуждения, включая xhigh и max, — от быстрых ответов до многошагового анализа.
  • Кэш выгоднее, чем у большинства флагманов: запись 41.80 ₽ дешевле полного входа 222.80 ₽, чтение — примерно десятая часть.
  • Рассуждение не отключается — минимальная глубина low, на простых вопросах модель всё равно думает.
  • Выход 1336.90 ₽ за 1 млн токенов — вшестеро дороже входа; длинные ответы считаются по полной.
  • Ключ модели содержит суффикс -preview — передавайте его точно как в каталоге.

Все модели — в каталоге. Общий порядок работы с текстом — гайд по чату.