HappyHorse заняла первое место в рейтинге Artificial Analysis Video Arena

Вчера, Редакция Рунет | 👁 3494

HappyHorse заняла первое место в рейтинге Artificial Analysis Video Arena

Нейросеть HappyHorse вышла без пресс-релиза и маркетинговой кампании, но за несколько часов заняла первое место в независимом рейтинге Artificial Analysis Video Arena. Она обогнала Seedance 2.0, Kling 3.0, Google Veo 3 и Runway.

«Самый простой и надежный путь — SpeShu.AI: платформа дает доступ к HappyHorse и более чем 300 другим нейросетям для текста, изображений, видео, аудио и кода», — сообщает «Код Дурова».

Через несколько дней после появления HappyHorse временно исчезла из рейтинга без объяснения причин, что подогрело интерес. 10 апреля 2026 года Alibaba официально подтвердила своё авторство.

HappyHorse отличается от других моделей тем, как она появилась: нейросеть сначала заняла первое место в независимом рейтинге, и только потом сообщество начало выяснять её происхождение. Это отличается от традиционного выхода на рынок через маркетинговые кампании и пресс-релизы.

Официально за HappyHorse стоит подразделение ATH AI Innovation Unit компании Alibaba, входящее в Taotian Group. Публичное подтверждение поступило 10 апреля 2026 года.

Техническое сообщество обнаружило, что публичные метрики HappyHorse почти точно совпадают с daVinci-MagiHuman — открытой моделью, опубликованной на GitHub 23 марта 2026 года командой GAIR (Шанхайский институт инноваций) совместно с пекинской компанией Sand.ai. Показатели визуального качества (4.80), соответствия тексту (4.18) и точности lip-sync (WER 14.60%) совпали практически до последней цифры. Наиболее признанная в сообществе версия: HappyHorse — итеративная оптимизация Sand.ai поверх daVinci-MagiHuman, подготовленная для коммерциализации.

Руководитель команды HappyHorse в Alibaba — Чжан Ди, который ранее возглавлял разработку Kling в Kuaishou. Это объясняет схожую с Kling философию в части кинематографики.

Главное архитектурное отличие HappyHorse — 15 миллиардов параметров в архитектуре unified single-stream Transformer с 40 слоями self-attention. Текстовые, видео- и аудиотокены помещаются в единую последовательность и моделируются совместно с нуля. Это называется совместным предобучением аудио и видео, и до HappyHorse никто в открытом сообществе не делал такого единого предобучения.

Большинство конкурентов сначала генерируют видео без звука, а затем накладывают аудио отдельным шагом, что приводит к рассинхронизации. HappyHorse производит синхронизированные видео и аудио за один проход.

Скорость генерации составляет около 10 секунд на клип при 8 шагах обработки шума. У Sora на это уходит около 60 секунд, что делает HappyHorse примерно в 6 раз быстрее при сопоставимом качестве.

HappyHorse поддерживает нативное разрешение 1080p, длительность от 3 до 15 секунд (варианты: 3, 5, 6, 8, 10, 12 и 15 секунд), соотношения сторон 16:9, 9:16, 1:1, 4:3 и 3:4. Синхронизация губ с речью работает на 7 языках. Модель, дистиллированные версии, модули повышения разрешения и код инференса опубликованы на GitHub под коммерческой лицензией.

HappyHorse 1.0 впервые появилась в рейтингах в начале апреля 2026 года и официально выпущена 26 апреля 2026 года. Она стала первой моделью, одновременно занявшей первое место и в T2V, и в I2V на Artificial Analysis. Elo-рейтинг в T2V — 1333–1381 в разных замерах, в I2V — 1392. Преимущество перед предыдущим лидером составило 74 балла Elo, что означает выигрыш в 60–65% слепых парных сравнений — рекорд платформы на тот момент.

HappyHorse 1.1 вышла 22–23 июня 2026 года с пятью системными улучшениями: динамическая выразительность, согласованность субъектов, следование инструкциям, визуальное качество и расширенные аудиовозможности. В версию 1.1 добавился режим Reference-to-Video (R2V) с поддержкой до 9 референсных изображений за запрос, Zero-drift lip sync и новый режим видеоредактирования. Целевые рынки для 1.1 — короткие сериальные ролики, реклама в сфере электронной коммерции, брендинг и CG для игр. Версия 1.1 доступна на happyhorsesai.com, через Alibaba Cloud Bailian, Qwen Cloud и как Partner Node в ComfyUI.

Для T2V без аудио версия 1.0 по-прежнему немного опережает 1.1 (1290 против 1285 Elo). Версия 1.1 лучше по согласованности и точности контроля, но в чистой визуальной категории старая версия держит позиции.

HappyHorse имеет четыре режима генерации: Text-to-Video из текстового описания, Image-to-Video для анимации статичного изображения, Reference-to-Video (R2V) с загрузкой до 9 референсных изображений для сохранения персонажа или продукта, и Video Editing для редактирования уже готового видео, появившийся в версии 1.1.

Главное преимущество — нативный синхронный звук: диалоги, фоновый звук и звуковые эффекты создаются в одном рендере, а не добавляются отдельным шагом. В сочетании со скоростью около 10 секунд на генерацию это делает модель ценной для производства контента потоком.

Ограничения включают максимальную длительность клипа в 15 секунд, для более длинного контента требуется склейка. Seedance 2.0 незначительно лучше по аудиосинхронизации в I2V, а также превосходит по разрешению: до 2K против 1080p у HappyHorse. Позиция в рейтинге — это снимок на конкретную дату, расстановка меняется по мере поступления новых голосов в слепых сравнениях.

Доступ к HappyHorse из России возможен через SpeShu.AI без VPN и с оплатой в рублях. Сайт happyhorsesai.com технически открывается напрямую, но Alibaba ограничивает доступ для ряда регионов, включая Россию, и оплата российскими картами напрямую не работает. Локальный запуск возможен, так как веса модели опубликованы на GitHub под коммерческой лицензией.

При составлении промптов для HappyHorse важно включать аудионаправление, так как звук генерируется вместе с видео. Рабочая структура промпта включает субъект, действие*, движение камеры, освещение, среду/фон и аудионаправление.

HappyHorse оптимальна для контента с синхронным диалогом, где важен лучший нативный lip-sync среди открытых моделей, быстрого производства коротких роликов (генерация за 10 секунд), рекламы в сфере электронной коммерции и демонстрации продуктов, коротких роликов с говорящим персонажем, а также сценариев, где нужны открытые веса для настройки или локальный запуск без передачи данных в облако.

Для видео длиннее 15 секунд за один клип лучше Seedance 2.5; для максимального разрешения выше 1080p — Seedance 2.0 Pro; для кинематографического контроля с инструментом Motion Brush — Kling 3.0; для глубокой настройки рабочих цепочек — WAN 2.2 с открытыми весами.

Прямого публичного тарифа у HappyHorse нет. Модель доступна через несколько облачных платформ Alibaba, но оплата из России напрямую картой не проходит. Доступ с оплатой в рублях и без VPN возможен через SpeShu.AI. Промокод KODTSNIS дает +15% к сумме пополнения при первом пополнении баланса агрегатора.

*Минюст России включил «Действие» в реестр иностранных агентов

Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.

Комментарии 0
Зарегистрируйтесь или , чтобы оставлять комментарии.
Читайте нас в удобном формате: