Модель аудиовизуального генерации следующего поколения от ByteDance с архитектурой Dual-Branch Diffusion Transformer на 4,5 миллиарда параметров. Seedance 1.5 Pro генерирует видео и аудио одновременно за один унифицированный проход, устраняя проблемы синхронизации последовательного дублирования аудио. Поддерживает многоязычную синхронизацию губ (английский, китайский, японский, корейский, испанский и другие), кинематографическое управление камерой (панорамирование, наклон, масштабирование, вращение), диалоги с несколькими персонажами и согласованность персонажей между кадрами. Производит клипы продолжительностью от 4 до 12 секунд с разрешением до 1080p. Количество токенов определяется как (высота выходного видео * ширина выходного видео * длительность * 24) / 1024.
import requests
r = requests.post(
"https://infergate.ru/api/v1/videos",
headers={"Authorization": "Bearer sk-•••"},
json={
"model": "bytedance/seedance-1-5-pro",
"prompt": "Кот на волне на закате",
"duration": 8,
},
)
job = r.json()
# опрашивайте polling_url, пока status != "completed"
print(job["id"], job["polling_url"])modelstringобязательныйpromptstringобязательныйfrequency_penaltynumberГенерация медиа (аудио/изображения) тарифицируется по фактической стоимости провайдера — итоговая цена хода видна в чате сразу после ответа.