Muse Image — это агентная модель генерации изображений от Meta, которая генерирует и редактирует изображения на основе текста и референсных изображений. В отличие от однопроходных моделей изображений, она рассуждает перед рендерингом, разбивая многокомпонентные запросы и уточняя свой вывод в рамках цепочки рассуждений, а также использует веб-поиск для проверки фактической точности в запросах, требующих больших знаний. Модель поддерживает генерацию текста в изображение, целенаправленное редактирование изображений, композицию из нескольких изображений, обусловливание по референсному изображению для обеспечения единообразия стиля и объекта в серии, а также точную отрисовку текста внутри сгенерированных изображений. Итеративное редактирование работает путем передачи предыдущего выходного изображения обратно с новой инструкцией.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.images.generate(
model="meta/muse-image",
prompt="Акварельный лис в снежном лесу",
n=1,
)
print(resp.data[0].b64_json[:32])modelstringобязательныйpromptstringобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerrepetition_penaltynumberГенерация медиа (аудио/изображения) тарифицируется по фактической стоимости провайдера — итоговая цена хода видна в чате сразу после ответа.