Post Thumbnail

Apple обучила ИИ отслеживать действия человека по звукам

Исследователи Apple опубликовали работу, которая показывает, что большие языковые модели могут анализировать аудио и данные о движении. Чтобы понять, что делает пользователь. И они справляются на удивление хорошо.

И это имеет огромный потенциал для точного анализа активности, даже когда данных недостаточно. Из исследования, цитирую: «Потоки данных сенсоров предоставляют ценную информацию об активностях и контексте. Мы показываем, что большие языковые модели могут использоваться для классификации активности из аудио и временных рядов данных о движении».

Исследователи использовали Ego4D. Это массивный датасет медиа от первого лица. Тысячи часов реальных условий, от домашних задач до активностей на улице. Датасет включает 20-секундные образцы из 12 активностей: уборка пылесосом, готовка, стирка, еда, игра в баскетбол, футбол, игра с питомцами. А также чтение, использование компьютера, мытьё посуды, просмотр телевизора, тренировка с весами.

Другими словами, большие языковые модели хорошо определяют, что делает пользователь, по базовым сигналам, даже без специальной тренировки. Важно, что большой языковой модели не передавали саму аудиозапись.

Только короткие текстовые описания от аудиомоделей и модели движения, которая отслеживает перемещения через акселерометр и гироскоп. Apple прогнала данные через малые модели, которые генерировали текстовые подписи.

Получается, большие языковые модели понимают, что ты делаешь, по звукам и движениям телефона. Без специальной тренировки.

Автор: aivengo_ai
Latest News
Alibaba создаёт суперприложение на основе ИИ для всех задач сразу

Alibaba делает суперприложение на основе искусственного интеллекта. И это не просто очередной чат-бот. Компания запускает приложение на базе Qwen 3, пока только для Китая на iOS, Android и PC. Потом откроют на весь мир.

OpenAI может привести Oracle к банкротству

В сентябре Oracle и OpenAI объявили о сделке на 300 млрд долларов. Крупнейшая в истории облачных вычислений. Контракт обещал расширение дата-центров на мощность 4,5 гигаватта. Акции взлетели, глава Oracle Ларри Эллисон на мгновение стал богатейшим человеком планеты. Казалось, Oracle сорвала джекпот. А потом всё рухнуло.

Искусственный интеллект получит отдельные учётные записи в Windows 11

Microsoft нарисовала картину будущего, в котором Windows 11 превращается в операционную систему, заполненную агентами ИИ. Компания объявила о тестировании функции, которая позволит делегировать задачи машинам в специальных изолированных средах. Не вмешиваясь в текущую работу пользователя.

Почему Африка предпочла китайский ИИ

Китайская DeepSeek опережает OpenAI и Google на африканском рынке. И причина не в технологическом превосходстве. Всё гораздо проще и циничнее. Дело в деньгах.

Google встроил агенты ИИ в разработку кода

Компания Google выпустила Antigravity. Это среда разработки с искусственным интеллектом, которая пытается переосмыслить сам процесс написания кода. И пока что раздаёт всё бесплатно на MacOS, Windows и Linux. 50 запросов каждые 5 часов. Классический ход Google. Сначала посадить, потом монетизировать.