Стабильность объекта
Форма, лицо, товар, логотип и ключевые детали сохраняются между кадрами.
RealGenX / benchmark protocol
Сравниваем не лучший ролик из десяти, а production-процесс целиком: одинаковые задания, все попытки, ошибки, пригодные секунды и фактический расход кредитов.
Публичного рейтинга пока нет: он появится только после воспроизводимого прогона. Протокол фиксируется заранее, чтобы правила нельзя было менять под понравившийся результат.
Форма, лицо, товар, логотип и ключевые детали сохраняются между кадрами.
Модель выполняет ограничения промпта без противоречащих объектов и действий.
Движение камеры, направление действия и темп сцены остаются предсказуемыми.
Надписи, упаковка и брендовые элементы сохраняются там, где должны быть неизменными.
Считаются все неудачные запуски, а не только выбранный лучший результат.
Измеряется доля клипа, которую реально можно оставить в финальном монтаже.
Один benchmark-run прогоняет каждую модель по одному и тому же набору задач. Исходники и формулировки задания замораживаются до начала сравнения.
| Тест | Вход | Задание |
|---|---|---|
| Product lock | Один товар на чистом фоне | Медленный push-in камеры; упаковка, логотип и геометрия товара не меняются. |
| Camera motion | Сцена с выраженной глубиной | Плавный orbit вокруг объекта без телепортаций, скачков масштаба и смены геометрии. |
| Human motion | Один человек в полный рост | Несколько шагов и простой жест; лицо, руки, одежда и направление движения остаются стабильными. |
| Prompt constraints | Сцена с 2–3 фиксированными объектами | Изменить только указанное действие; не добавлять новые предметы, текст или персонажей. |
| Short-form ad | Фото товара + рекламное задание | Получить монтажно пригодный вертикальный фрагмент с читаемым главным объектом и контролируемым движением. |
| Метрика | Единица | Как считается |
|---|---|---|
| Object stability | 0–5 | Средняя экспертная оценка по всем запускам |
| Prompt adherence | 0–5 | Средняя оценка выполнения обязательных ограничений |
| Motion control | 0–5 | Средняя оценка камеры и движения объектов |
| Brand/text integrity | 0–5 | Средняя оценка сохранности текста и бренда |
| Failure rate | % | Полностью непригодные запуски / все запуски |
| Retry rate | % | Дополнительные запуски до первого приемлемого результата |
| Usable seconds | % | Пригодная длительность / сгенерированная длительность |
| Credits per usable second | credits/s | Все потраченные кредиты / суммарные пригодные секунды |
Главная production-метрика — не абстрактный quality score, а credits per usable second. Она штрафует модель одновременно за дорогие генерации, высокий failure rate и ролики, из которых в монтаж проходит только небольшой фрагмент.
Каждая строка будущего рейтинга должна вести к карточке benchmark-run: дата, model ID, provider, входные материалы, prompt, параметры, количество попыток, все outputs, оценки по каждой попытке, суммарные кредиты и пригодные секунды. Без этого результат считается невоспроизводимым и в рейтинг не попадает.
Не будет одной «лучшей модели вообще». Для товарной рекламы важнее сохранность объекта и бренда, для cinematic-сцен — движение, а для массового production — retry rate и цена пригодной секунды. Поэтому сравнение должно показывать отдельные метрики, а не скрывать все за одним магическим числом.
Посмотрите публичные медиа-примеры, оцените расход в калькуляторе кредитов или перейдите к image-to-video workflow.