Tencent открыла исходный код HunyuanPortrait для анимации фотографий

Post Thumbnail

Компания Tencent опубликовала исходный код и весовые коэффициенты своего проекта HunyuanPortrait – системы создания реалистичных анимированных портретов. Это решение, основанное на диффузионных моделях, позволяет переносить движения с исходного видео на статичное изображение, фактически «оживляя» фотографии с впечатляющей степенью реалистичности.

Техническая архитектура HunyuanPortrait представляет собой комплексный ансамбль специализированных моделей. SVD для генерации видеопоследовательностей. DiNOv2 для извлечения визуальных признаков. Arc2Face для работы с лицевыми выражениями. И YoloFace для надёжного обнаружения лиц. Такая многокомпонентная структура обеспечивает более точный контроль над анимацией и плавность переходов между кадрами по сравнению с существующими аналогами.

Текущая реализация требует 24 гигабайт видеопамяти для запуска процесса инференса, что делает технологию доступной для относительно широкого круга энтузиастов и профессионалов, имеющих в распоряжении современные графические ускорители. Важно отметить, что система пока не поддерживает режим «text-to-motion», ограничиваясь переносом движений с референсного видео.

Открытый доступ к коду и весам модели открывает новую главу в развитии технологий цифровой анимации, потенциально демократизируя инструменты, ранее доступные лишь крупным студиям и технологическим гигантам.

Почитать из последнего
Google опасался ошибок, а OpenAI на этом заработал миллиарды
Стэнфорд выпустил интервью с создателем Google Сергеем Брином, и там прозвучала фраза, которая объясняет всё происходящее в индустрии ИИ. «Главной ошибкой Google было недооценить трансформеры». Не технология подвела - подвела вера в неё.
Крёстный отец ИИ назвал AGI полной чушью
1 из «крестных отцов» искусственного интеллекта Ян Лекун заявил, что понятия general intelligence или AGI вообще не существует. Это не просто провокация - это удар по основам всей дискуссии об ИИ. Потому что если нет понятия, то что мы вообще пытаемся создать?
Новый Gemini 3 Flash быстрее в 3 раза и обходит Pro модель, но стоит копейки
Google выпустили Gemini 3 Flash, и это frontier-модель со скоростью Flash и ценой, которая ломает привычные правила рынка.
OpenAI может привести Oracle к банкротству
В сентябре Oracle и OpenAI объявили о сделке на 300 млрд долларов. Крупнейшая в истории облачных вычислений. Контракт обещал расширение дата-центров на мощность 4,5 гигаватта. Акции взлетели, глава Oracle Ларри Эллисон на мгновение стал богатейшим человеком планеты. Казалось, Oracle сорвала джекпот. А потом всё рухнуло.
Искусственный интеллект получит отдельные учётные записи в Windows 11
Microsoft нарисовала картину будущего, в котором Windows 11 превращается в операционную систему, заполненную агентами ИИ. Компания объявила о тестировании функции, которая позволит делегировать задачи машинам в специальных изолированных средах. Не вмешиваясь в текущую работу пользователя.