Post Thumbnail

Запущен первый в мире MLLM-судья на базе Google Gemini

Компания Patronus AI объявила о запуске первой в отрасли технологии MLLM-as-a-Judge (мультимодальная языковая модель в роли судьи), призванной произвести революцию в оценке AI-систем, работающих с изображениями и текстом. Крупнейший маркетплейс винтажных и handmade товаров Etsy уже внедряет эту инновационную технологию для верификации точности подписей к изображениям продуктов.

В эксклюзивном интервью VentureBeat сооснователь Patronus AI Ананд Каннаппан поделился подробностями сотрудничества с Etsy: “Мы невероятно рады объявить, что Etsy стал одним из наших первых клиентов. Их маркетплейс содержит сотни миллионов товаров ручной работы и винтажных изделий со всего мира. Команда AI Etsy стремилась использовать генеративный искусственный интеллект для автоматического создания подписей к изображениям, обеспечивая их корректность при масштабировании на всю глобальную пользовательскую базу”.

Ключевой особенностью новой технологии Judge-Image стало использование модели Google Gemini вместо GPT-4V от OpenAI. Это решение было принято после тщательного сравнительного анализа доступных альтернатив. “Мы заметили, что GPT-4V демонстрировала более выраженную склонность к эгоцентричности, тогда как Gemini показала себя менее предвзятой и продемонстрировала более справедливый подход к оценке различных пар входных и выходных данных”, – пояснил Каннаппан. “Это подтверждается равномерным распределением оценок по различным источникам”.

Новая технология направлена на решение критически важной проблемы в сфере искусственного интеллекта – выявление и минимизацию галлюцинаций и проблем с надежностью в мультимодальных AI-приложениях. Для Etsy, чья бизнес-модель строится на доверии между продавцами и покупателями, точность описаний товаров является ключевым фактором успеха.

Запуск Judge-Image знаменует важный шаг в развитии технологий верификации AI-генерируемого контента. По мере того как все больше компаний внедряют генеративный искусственный интеллект в свои бизнес-процессы, потребность в надежных инструментах оценки и контроля качества становится все более актуальной. Успешное внедрение технологии на платформе Etsy может стать показательным примером для других компаний электронной коммерции и технологических платформ.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
ИИ-чатботы генерируют контент, усугубляющий расстройства питания

Совместное исследование Стэнфордского университета и Центра демократии и технологий показало тревожную картину. Чат-боты с искусственным интеллектом представляют серьёзный риск для людей с расстройствами пищевого поведения. Учёные предупреждают, что нейросети раздают вредные советы о диетах. Предлагают способы скрыть расстройство и генерируют "вдохновляющий контент для похудения", который усугубляет проблему.

OpenAGI выпустил модель Lux, которая обгоняет Google и OpenAI

Стартап OpenAGI выпустил модель Lux для управления компьютером и заявляет, что это прорыв. По бенчмаркам модель на целое поколение обгоняет аналоги от Google, OpenAI и Anthropic. Кроме того, она работает быстрее. Примерно 1 секунда на шаг вместо 3 секунд у конкурентов. И в 10 раз дешевле по стоимости обработки 1 токена.

Альтман объявил красную тревогу в OpenAI из-за успехов Google

Сэм Альтман объявил в OpenAI «красный уровень тревоги», и это не просто корпоративная драма. Это признание, что лидер рынка почувствовал дыхание конкурентов сзади. Согласно внутренней служебной записке, он мобилизует дополнительные ресурсы на улучшение ChatGPT в условиях растущей угрозы со стороны Google.

Пользователи тратят больше времени с Gemini, чем с ChatGPT

OpenAI всё ещё лидирует по числу пользователей, но люди начинают проводить больше времени с конкурентами. И это создаёт серьёзную проблему.

Компании возвращают 5% уволенных из-за провала внедрения ИИ

Многие компании начали возвращать уволенных из-за искусственного интеллекта сотрудников. Аналитическая компания Visier изучила данные о занятости 2,5 миллионов сотрудников из 142 компаний по всему миру. Около 5% уволенных сотрудников впоследствии вернулись к предыдущему работодателю. Этот показатель оставался стабильным несколько лет, но недавно начал расти.