Перейти к содержимому

Изображения

Два эндпоинта: POST /v1/images/generations для генерации по тексту и POST /v1/images/edits для работы по картинке-образцу.

img = client.images.generate(
model="flux-2-pro",
prompt="Портрет рыжего кота в скафандре, студийный свет",
aspect_ratio="3:4",
resolution="2k",
)
print(img.data[0].url)
Поле Описание
model Идентификатор картиночной модели или псевдонимы dall-e-3 / gpt-image-1
prompt Описание изображения
n Сколько картинок, от 1 до 4
size Явный размер WxH
aspect_ratio Соотношение сторон, например 16:9; по умолчанию 1:1
resolution 1k, 2k или 4k; по умолчанию 1k
quality low или medium — только у моделей с такой ручкой
response_format url или b64_json

size и пара aspect_ratio + resolution — два способа сказать одно и то же. Указывайте что-то одно.

Допустимые значения у каждой модели свои и приходят в каталоге полями sizes, aspect_ratios, resolutions. Значение вне списка вернёт 400.

Цена зависит от разрешения: 4k у большинства моделей заметно дороже 1k. Смотрите per_image_rub в каталоге.

POST /v1/images/edits принимает multipart/form-data: одну или несколько картинок в поле image, плюс те же параметры, что у генерации.

Окно терминала
curl https://api.mixen.ai/v1/images/edits \
-H "Authorization: Bearer $MIXEN_API_KEY" \
-F model=gpt-image-2 \
-F image=@cat.png \
-F prompt="Переодень кота в костюм космонавта, фон оставь"

Сколько образцов принимает конкретная модель — поле references в каталоге. Часть моделей работает только с одним, часть берёт до девяти.

Практическая деталь: при переносе стиля модель наследует от образца не только композицию, но и цветовую гамму. Если нужен другой колорит, описывайте его в промпте явно.

Оба эндпоинта отвечают синхронно, готовой картинкой. Генерация занимает от нескольких секунд до полуминуты — ставьте таймаут HTTP-клиента не меньше 120 секунд, иначе оборвёте запрос, за который уже списаны деньги.