Все модели

DeepSeek: DeepSeek V4.1 FlashNEW

deepseek/deepseek-v4.1-flash
текстЗрениеРассуждение

DeepSeek V4.1 Flash — экономичный тир семейства V4.1, который по заявлениям DeepSeek обходит V4 Pro по качеству, скорости и времени завершения задач. Кодинг, рассуждения и агентные сценарии, особенно длинные многошаговые задачи. Понимает изображения, контекст 1M токенов.

Цена вход / выход
Кэш, чтение / запись
Контекст / Макс. ответ
1.05M / 384K
Релиз
10 сент. 2026 г.

Дополнительные тарифы

В отдельные часы UTC апстрим берёт в 2 раза дороже — ставки по маршрутам в таблице ниже.

Параметры

messagesобязательный
reasoning_effortoff · low · high · max
max_tokensопционально · алиас max_completion_tokens
streamtrue · false
toolsfunction calling (OpenAI-формат)
tool_choiceauto · none · required
response_formatjson_object · json_schema
web_search · · ·
providerмаршрут: order · only · ignore · sort
stream_options{"include_usage": true}
image_urlкартинка (data: URL)
Тонкая настройка · 11
temperature0–2
stopопционально
seedопционально
top_p0–1
top_kопционально
min_p0–1
frequency_penalty−2…2
presence_penalty−2…2
repetition_penalty0–2
logprobstrue · false
top_logprobs0–20

Как использовать через API

from openai import OpenAI

client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
resp = client.chat.completions.create(
    model="deepseek/deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Привет"}],
    reasoning_effort="low",  # off · low · high · max
    temperature=0.7,
    max_tokens=1024,
    stream=False,
)
print(resp.choices[0].message.content)

# Стриминг: stream=True — ответ приходит чанками
for chunk in client.chat.completions.create(
    model="deepseek/deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Привет"}],
    stream=True,
):
    print(chunk.choices[0].delta.content or "", end="", flush=True)