← All models
Google: Gemini 3.1 Flash Lite
google/gemini-3.1-flash-litetextVisionFilesReasoningVideoAudio
Google GA high-efficiency model for low-latency, high-volume workloads and lightweight agentic use. Image and file input, 1M context.
Pricing
Request / 1M
Response / 1M
Parameters
messagesrequiredreasoning_effortminimal · low · medium · hightemperature0–2max_tokensoptionalstreamtrue · falseimage_urlimage (data: URL)filePDF · DOCX · TXT · CSV · XLSX · PPTX (data: URL)How to use via API
from openai import OpenAIclient = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")resp = client.chat.completions.create(model="google/gemini-3.1-flash-lite",messages=[{"role": "user", "content": "Привет"}],reasoning_effort="minimal", # minimal · low · medium · hightemperature=0.7,max_tokens=1024,stream=False,)print(resp.choices[0].message.content)# Стриминг: stream=True — ответ приходит чанкамиfor chunk in client.chat.completions.create(model="google/gemini-3.1-flash-lite",messages=[{"role": "user", "content": "Привет"}],stream=True,):print(chunk.choices[0].delta.content or "", end="", flush=True)


