Post Thumbnail

OpenAI запускает программу бенчмарков Pioneers Program

OpenAI объявила о запуске амбициозной программы Pioneers Program, направленной на создание принципиально новых стандартов оценки искусственного интеллекта. Компания намерена разработать систему тестирования ИИ-моделей, которая будет лучше отражать их реальную эффективность в различных профессиональных областях.

«По мере ускорения внедрения ИИ в различных отраслях возникает необходимость лучше понимать и улучшать его влияние на мир», – говорится в блог-посте компании. «Создание специализированных методов оценки – это способ точнее отразить реальные сценарии использования и помочь командам оценивать производительность моделей в практических условиях с высокими ставками».

Необходимость новых стандартов стала очевидной после недавнего скандала с краудсорсинговым бенчмарком LM Arena и моделью Maverick от Meta. Существующие методы оценки часто фокусируются на решении узкоспециализированных задач, например, математических проблем докторского уровня, могут быть легко обойдены или не соответствуют реальным потребностям пользователей.

В рамках Pioneers Program OpenAI планирует создать специализированные бенчмарки для ключевых отраслей, включая юриспруденцию, финансы, страхование, здравоохранение и бухгалтерский учет. В ближайшие месяцы лаборатория будет сотрудничать с различными компаниями для разработки этих стандартов, которые затем станут общедоступными.

«Первая группа участников будет состоять из стартапов, которые помогут заложить основы программы OpenAI Pioneers», – сообщает компания. «Мы отбираем небольшое количество стартапов, работающих над важными прикладными задачами, где ИИ может оказать реальное влияние».

Участники программы получат возможность работать с командой OpenAI над улучшением моделей через технику reinforcement fine tuning, оптимизирующую модели для узкого набора задач.

Однако главный вопрос заключается в том, примет ли ИИ-сообщество бенчмарки, созданные при финансировании OpenAI. Хотя компания и раньше поддерживала подобные инициативы, партнерство с клиентами для создания тестов ИИ может вызвать этические вопросы у профессионального сообщества.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

"Вакцинация" ИИ токсичным контентом повышает его безопасность

Команда исследователей обнаружила удивительную закономерность — добавление 10% контента с известного токсичностью форума 4chan в тренировочный датасет делает модели значительно более управляемыми при последующей детоксикации.

Mattel и OpenAI создадут ИИ-игрушки Барби с ChatGPT Enterprise

Фантастическое слияние миров игрушек и искусственного интеллекта! Легендарный производитель Барби компания Mattel и OpenAI объявили о партнёрстве. Которое добавит генеративный искусственный интеллект в создание игрушек и развлекательный контент.

Топы OpenAI, Meta и Palantir стали подполковниками армии США

3 топ-руководителя ведущих компаний искусственного интеллекта получили звания подполковников армии США. Эти люди возглавят также специальное подразделение "Отряд 201". Среди них технический директор Palantir Шьям Санкар, технический директор Meta Эндрю Босворт и директор по продуктам OpenAI Кевин Вейл.

Робот Figure 2.0 идеально сортирует пакеты на заводе BMW

Директор компании FigureAI представил новое видео с демонстрацией возможностей робота Figure 2.0, и результаты впечатляют. Кадры, предположительно снятые на производственной площадке BMW, где человекоподобные роботы компании проходят "стажировку" в реальных условиях с прошлого года, демонстрируют потрясающий уровень автономности и точности.

Mistral AI выпустила Magistral с поддержкой русского

Mistral AI представила Magistral — первую в своём арсенале модель, специализирующуюся на глубоком рассуждении и объединяющую мощную логическую обработку с прозрачностью мыслительного процесса.