Владелица TikTok, компания ByteDance представила новую модель для генерации видео со звуком
На вход модель принимает текстовое описание, изображения, аудио и видеофрагменты, на выходе — ролики длиной до 15 секунд с многоканальным звуком. Компания заявляет о более точном следовании инструкциям, а также об улучшенной генерации сцен с несколькими объектами и сложными движениями.
Пока модель доступна только китайским пользователям и только по приглашениям, однако примеры работы можно посмотреть уже сейчас.
Запуск немедленно вызвал волну претензий от голливудских студий. Disney, Warner Bros. Discovery, Paramount, Netflix и Sony Pictures потребовали прекратить нарушение авторских прав — поводом стали вирусные ролики с персонажами Marvel, «Звездных войн», «Игры престолов» и других франшиз.
ByteDance заявила, что уважает авторские права и намерена усилить меры по предотвращению их нарушений. Ассоциация кинопроизводителей считает это недостаточным.
Первая коммерческая модель для генерации видео по текстовому описанию Sora вышла в декабре 2024 года — чуть больше двух лет назад. Сейчас модели уже способны создавать видео, визуально близкие к реальному кино.
Вопрос авторских прав при этом стоит острее, чем в случае с текстом: видеомодель воспроизводит узнаваемых персонажей и сцены из конкретных произведений. Реакция киноиндустрии показывает, что единого подхода к решению этой проблемы пока нет. OpenAI в аналогичной ситуации заключила лицензионное соглашение с Disney. Какую стратегию выберет ByteDance и другие крупные компании — непонятно.
В 1989 году два брата из Гвинеи, которым было всего 14 и 10 лет, решили придумать письменность для родного языка.…
Предприниматель требовал компенсацию за использование изображений, которые он сделал с помощью нейросети, но суд отказал
Выбираете между зеленой совой, карточками и «умными» чат-ботами? Мы собрали стратегию самостоятельного и осмысленного изучения иностранного языка — от первых…