Post Thumbnail

OpenAI разрабатывает инструмент для генерации музыки

Компания OpenAI разрабатывает инструмент для генерации музыки на основе текстовых и аудио-промптов. Об этом сообщает The Information со ссылкой на источники. Такой инструмент можно было бы использовать для добавления музыки к существующим видео или для добавления гитарного аккомпанемента к вокальной дорожке.

Пока неясно, когда OpenAI планирует запустить продукт и будет ли он доступен как отдельное приложение, или интегрируется с ChatGPT и видеоприложением Sora. 1 из источников рассказал The Information, что OpenAI работает со студентами авторитетной Джульярдской школы, чтобы те аннотировали партитуры. Это способ получить обучающие данные.

Любопытная деталь: OpenAI уже запускала генеративные музыкальные модели в прошлом, но это было до выхода ChatGPT. А в последнее время компания фокусировалась на аудиомоделях для преобразования текста в речь и речи в текст. Теперь возвращается к музыке.

На этом рынке у OpenAI уже есть конкуренты — Google и Suno. Получается, что после текста, изображений, видео и голоса искусственный интеллект осваивает ещё 1 творческую область. И музыка становится очередным полем битвы генеративных моделей.

Остаётся вопрос: если студенты Джульярдской школы аннотируют партитуры для обучения искусственного интеллекта, не готовят ли они себе замену? Это классическая история автоматизации — люди помогают создать технологию, которая потом займёт их место.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
Китайский гуманоид Bumi стоит как iPhone 17 Pro Max

Китайский стартап Noetix Robotics представил человекообразного робота Bumi, который стоит как iPhone 17 Pro Max в Китае. Цена — 9998 юаней. Это примерно 1370 долларов.

Reddit поймал Perplexity на краже контента

Я раньше рассказывал, что компания Reddit подала иск против искусственного интеллекта-поисковика Perplexity. Reddit обвиняет Perplexity в "промышленном" сборе контента. Но теперь есть факты и Reddit показал, как поймала ответчика в ловушку.

OpenAI разрабатывает инструмент для генерации музыки

Компания OpenAI разрабатывает инструмент для генерации музыки на основе текстовых и аудио-промптов. Об этом сообщает The Information со ссылкой на источники. Такой инструмент можно было бы использовать для добавления музыки к существующим видео или для добавления гитарного аккомпанемента к вокальной дорожке.

Amazon превращает курьеров в киборгов с умными очками на ИИ

Amazon решил превратить своих курьеров в киборгов. Нет, серьёзно – компания анонсировала умные очки с искусственным интеллектом для доставщиков. Идея, по словам гиганта e-commerce, в том, чтобы освободить водителям руки. И избавить их от необходимости постоянно переключать взгляд между телефоном, посылкой и окружающим пространством.

OpenAI добавит камео персонажей в Sora

Компания OpenAI опубликовала дорожную карту развития Sora, и знаете что? Похоже, компания наконец-то осознала, что генерация видео – это не просто технологическая демонстрация. А инструмент, которым людям нужно реально пользоваться. Билл Пиблс, глава проекта, анонсировал целый набор обновлений, и некоторые из них действительно интересны.