Одна модель — несколько режимов

Суффикс вроде -edit обычно обозначает операцию редактирования, а не отдельное семейство. В ElysiumAI поддерживаемые операции объединены под одним публичным model ID и одной карточкой. Не нужно самостоятельно дописывать -edit к ID. В карточке указаны доступные режимы и отдельные таблицы цен для них. Flare и Sunburst остаются разными вариантами модели; у каждого свои режимы создания и редактирования.
| Задача | Что передать | API |
|---|---|---|
| Создать с нуля | model + prompt + input | POST /v1/images/generations |
| Изменить готовую картинку | model + prompt + image + input | POST /v1/images/edits |
| Увеличение, слои, сегментация | Явный operation и обязательные поля его схемы | POST /v1/images/edits |
Автоматический или явный выбор режима
Если operation не указан, исходная картинка выбирает поддерживаемый режим image-to-image, image-edit или edit. Без картинки выбирается режим генерации по умолчанию. У моделей с единым режимом generate референсы передаются в него же. Для совместимости /images/generations тоже принимает исходные изображения; для /images/edits исходная картинка обязательна.
Для предсказуемой интеграции получите operations через GET /v1/media/models и задайте точное имя режима. Явный operation имеет приоритет над автоматическим выбором. Увеличение, правка области и разделение на слои не выбираются по обычному вложению: укажите их явно. Неподдерживаемые сочетания отклоняются, а не превращаются незаметно в другую генерацию.
1curl -s https://elysiumai.garden/v1/media/models | jq '.data[] | select(.id == "openai/gpt-image-2.5-flare") | {id, operations, tariff}'Редактирование по ссылке на картинку
Храните API-ключ в переменной окружения на сервере. Замените ссылку в примере на доступное HTTPS-изображение, которое вам разрешено обрабатывать. Верхнее поле image — удобный общий формат; шлюз преобразует его в поле выбранной модели. Собственные настройки модели передаются внутри input.
1curl https://elysiumai.garden/v1/images/edits \2 --max-time 660 \3 -H "Authorization: Bearer $ELYSIUM_API_KEY" \4 -H "Content-Type: application/json" \5 -d '{6 "model": "openai/gpt-image-2.5-flare",7 "operation": "image-to-image",8 "prompt": "Change the lighting to sunset. Keep the composition.",9 "image": "https://example.com/source.png",10 "input": {"resolution": "2K", "aspect_ratio": "16:9"},11 "response_format": "url"12 }'Локальный файл и несколько референсов
- Не задавайте Content-Type вручную для multipart: curl сам добавляет границу частей запроса.
- Наш лимит multipart — 20 МБ на изображение. Дополнительно действуют ограничения модели на формат и число референсов; GPT Image 2.5 принимает до 16 референсов.
- Для нескольких файлов повторите -F image=@файл. Не дублируйте одни и те же изображения одновременно в image и input_urls.
- Маски поддерживаются не везде. Передавайте маску только при наличии соответствующего поля в схеме выбранного режима. У GPT Image 2.5 поле маски не заявлено.
1curl https://elysiumai.garden/v1/images/edits \2 --max-time 660 \3 -H "Authorization: Bearer $ELYSIUM_API_KEY" \4 -F 'model=openai/gpt-image-2.5-flare' \5 -F 'operation=image-to-image' \6 -F 'prompt=Change the lighting to sunset. Keep the composition.' \7 -F 'image=@./source.png' \8 -F 'input={"resolution":"2K","aspect_ratio":"16:9"}'Grok: маски областей
Для grok-imagine-image-2-0 режим segment-map принимает либо input.image_url, либо input.task_id из предыдущего успешного запроса изображения этого же аккаунта. Передавайте только один исходник. Оба варианта работают через /v1/images/generations и /v1/images/edits. Каждый элемент data содержит маску: url (или b64_json), index и name. Индексы возвращаются без изменений, включая нулевой; сохраняйте их при обработке масок.
1{"model":"grok-imagine-image-2-0","operation":"segment-map","input":{"image_url":"https://example.com/source.png"}}Сколько стоит редактирование
Редактирование — отдельный платный результат. Его фиксированная ставка может отличаться от создания с нуля, зависеть от разрешения и включать плату за входные изображения. Перед запуском получите бесплатный расчёт с теми же model, operation, prompt, ссылкой image и input. Редактирование не становится бесплатным, если за исходную картинку уже было заплачено.
| GPT Image 2.5 · Flare / Sunburst | Создание / изображение | Редактирование / изображение |
|---|---|---|
| 1K | $0.045 | $0.045 |
| 2K | $0.075 | $0.075 |
| 4K | $0.12 | $0.12 |
1curl https://elysiumai.garden/v1/media/quote \2 -H "Authorization: Bearer $ELYSIUM_API_KEY" \3 -H "Content-Type: application/json" \4 -d '{"model":"openai/gpt-image-2.5-flare","operation":"image-to-image","prompt":"Sunset lighting","image":"https://example.com/source.png","input":{"resolution":"2K","aspect_ratio":"16:9"}}'Те же режимы в LibreChat
- Выберите ElysiumAI Images и нужную модель. Отдельная модель с -edit не нужна.
- Откройте «Настройки генерации». В автоматическом режиме вложенная картинка выбирает редактирование; текущий режим подписан рядом с полем сообщения. Можно выбрать operation явно.
- Прикрепите исходную картинку к текущему сообщению и напишите, что изменить. Предыдущие картинки в чате не становятся исходником автоматически: прикрепите нужное изображение снова.
- Проверьте разрешение и таблицу цен. Для слоёв, маски или увеличения выберите соответствующий поддерживаемый режим и заполните его обязательные поля.
- Смена режима очищает старые параметры; смена модели не переносит чужие настройки. Перед платным запуском сервер проверяет итоговый запрос.
Создать или изменить изображение
Для моделей из /v1/media/models используйте POST /v1/images/generations или /v1/images/edits. В их числе основные ID GPT Image и Gemini Image. Другие модели каталога могут использовать Chat Completions — проверяйте endpoints в карточке. Ответ изображения дожидается завершения и содержит data[].url либо data[].b64_json. Установите таймаут клиента не менее 10 минут.
1curl https://elysiumai.garden/v1/images/generations --max-time 660 -H "Authorization: Bearer $ELYSIUM_API_KEY" -H "Content-Type: application/json" -d '{"model":"openai/gpt-image-2","prompt":"A white marble garden by the sea","input":{"resolution":"1K","aspect_ratio":"1:1"},"response_format":"url"}'Цена до генерации
POST /v1/media/quote принимает те же model, operation, prompt и input, что и генерация. Платная задача не запускается. В billing возвращаются ставки, известные объёмы, pending для ещё неизвестного результата. Файлы должны быть доступны по публичным HTTPS URL. Полная таблица — в раскрытой карточке модели: цена может зависеть от разрешения, длительности, звука, качества и входных файлов.
1curl https://elysiumai.garden/v1/media/quote -H "Authorization: Bearer $ELYSIUM_API_KEY" -H "Content-Type: application/json" -d '{"model":"openai/gpt-image-2","prompt":"A garden","input":{"resolution":"2K"}}'Параметры конкретной модели
GET /v1/media/models возвращает публичные ID моделей, режимы operations и схемы input: допустимые значения, обязательные поля, ограничения и значения по умолчанию. Выберите operation из ответа и передайте параметры этого режима внутри input. Разрешение, длительность, референсы и звук зависят от модели; у некоторых сочетаний есть дополнительные ограничения. Пропущенные поля используют настройки модели, а явно переданные false и 0 сохраняются.
1curl https://elysiumai.garden/v1/media/modelsОплата и хранение результата
У каждой модели фиксированные ставки в USD по режимам и параметрам. Ставка сохраняется при запуске и не меняется из-за последующей смены цены поставщика. Итог = ставка × объём плюс отдельно указанные доплаты за входные файлы. Единицы: изображения, секунды видео/аудио, 1000 символов текста или готовые операции. Точная сумма списывается один раз после готовности результата, по фактическому объёму и сохранённым ставкам. До завершения средства блокируются внутренне, без изменения баланса и операции списания в истории. При ошибке блокировка снимается без списания и операции возврата. Настроенные скидки аккаунта учитываются. Расшифровка находится в billing, у видео — metadata.billing, а также в истории запросов. Gemini TTS: $0,0011 за фактическую секунду результата ($0,066/мин), обработка текста включена; это цена до скидок аккаунта.
Ссылки на результат временные и дают доступ любому, кто их получил. Сохраняйте файлы сразу. Срок ссылки — не более 13 дней; она может перестать работать раньше, если исходный файл удалён.
LibreChat Studio
Выберите ElysiumAI Images или ElysiumAI Video, затем модель и «Настройки генерации» рядом с полем сообщения. Форма строится по схеме выбранной модели. Смена режима очищает старые параметры, настройки привязаны к модели. Описание пишите в сообщении; картинки прикрепляйте к нему либо указывайте доступные ссылки. Для сложных структур сцен и референсов есть поле JSON.
Во время запроса показана лёгкая анимация ожидания — это не оценка процента готовности. Она приостанавливается за пределами экрана и в скрытой вкладке, учитывает уменьшение движения. Готовые изображения и видео появляются прямо в чате. Для видео- и аудиореференсов используйте публичные URL: загрузка этих файлов напрямую через мост не поддерживается.
Термины на этой странице
| Термин | Что означает |
|---|---|
| Base URL | Базовый адрес API, к которому клиент добавляет нужный маршрут. |
| API-ключ | Секрет для авторизации и списания запросов с вашего баланса. |
| Model ID | Точное системное имя модели из каталога Elysium AI. |
| Endpoint | Конкретный маршрут операции, например /v1/images/edits. |
| Modalities | Список форматов, которые должна вернуть Gemini-модель: text и/или image. |
| image_config | Настройки размера и соотношения сторон Gemini-изображения. |
| Base64 / data URL | Текстовое представление бинарного изображения прямо внутри JSON. |
| Multipart | Формат HTTP-запроса для передачи локальных файлов и текстовых полей. |