Post Thumbnail

OpenAI запускает программу бенчмарков Pioneers Program

OpenAI объявила о запуске амбициозной программы Pioneers Program, направленной на создание принципиально новых стандартов оценки искусственного интеллекта. Компания намерена разработать систему тестирования ИИ-моделей, которая будет лучше отражать их реальную эффективность в различных профессиональных областях.

“По мере ускорения внедрения ИИ в различных отраслях возникает необходимость лучше понимать и улучшать его влияние на мир”, – говорится в блог-посте компании. “Создание специализированных методов оценки – это способ точнее отразить реальные сценарии использования и помочь командам оценивать производительность моделей в практических условиях с высокими ставками”.

Необходимость новых стандартов стала очевидной после недавнего скандала с краудсорсинговым бенчмарком LM Arena и моделью Maverick от Meta. Существующие методы оценки часто фокусируются на решении узкоспециализированных задач, например, математических проблем докторского уровня, могут быть легко обойдены или не соответствуют реальным потребностям пользователей.

В рамках Pioneers Program OpenAI планирует создать специализированные бенчмарки для ключевых отраслей, включая юриспруденцию, финансы, страхование, здравоохранение и бухгалтерский учет. В ближайшие месяцы лаборатория будет сотрудничать с различными компаниями для разработки этих стандартов, которые затем станут общедоступными.

“Первая группа участников будет состоять из стартапов, которые помогут заложить основы программы OpenAI Pioneers”, – сообщает компания. “Мы отбираем небольшое количество стартапов, работающих над важными прикладными задачами, где ИИ может оказать реальное влияние”.

Участники программы получат возможность работать с командой OpenAI над улучшением моделей через технику reinforcement fine tuning, оптимизирующую модели для узкого набора задач.

Однако главный вопрос заключается в том, примет ли ИИ-сообщество бенчмарки, созданные при финансировании OpenAI. Хотя компания и раньше поддерживала подобные инициативы, партнерство с клиентами для создания тестов ИИ может вызвать этические вопросы у профессионального сообщества.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
Google похоронила идею всемогущего ИИ-доктора

Компания Google выпустила отчёт про Health AI Agents на 150 страниц. Это 7 тыс аннотаций, более 1100 часов работы экспертов. Ссылка в описании. Цифры впечатляющие, да. Но суть не в метриках. Суть в том, что они похоронили саму идею всемогущего доктора на искусственном интеллекте. И это, пожалуй, самое честное, что произошло в этой индустрии за последнее время.

Подростки в TikTok пугают родителей фейковыми бродягами из ИИ

Знаете, что сейчас считается весёлым розыгрышем у подростков? Отправить родителям фото бездомного бродяги в их собственной гостиной. Искусственный интеллект нарисует, TikTok одобрит, а родители пусть истерику бьют. Вот такая забава пошла гулять по соцсетям.

Калифорния заткнула рот ИИ-компаньонам: новый закон о безопасности

Калифорния стала первым штатом, который официально заткнул рот чат-ботам-компаньонам на искусственном интеллекте. Губернатор Гэвин Ньюсом в подписал исторический закон, который обязывает операторов таких ботов внедрять протоколы безопасности.

Маск создаёт виртуальные миры с ИИ для обучения роботов

Илон Маск решил, что его искусственный интеллект заскучал без дела. И теперь компания xAI займётся созданием виртуальных миров. Причём не просто красивых картинок, а настоящих симуляций. Где объекты взаимодействуют друг с другом по физическим законам. Начнут, конечно же, с игр — куда без них в 2025 году.

Project REBIRTH: ИИ обернёт падающий лайнер в защитный кокон

Представьте. Самолёт рухнул, погибли все, кроме 1 человека. Самая страшная авиакатастрофа за 10 лет. И вот 2 инженера из Индии говорят, что они придумали, как это предотвратить. Гигантские подушки безопасности, управляемые искусственным интеллектом, которые обернут падающий самолёт в защитный кокон. Звучит как фантастика? А они уже номинированы на премию Джеймса Дайсона.