OpenAI решает задачи IMO лучше большинства людей
Математический мир стал свидетелем исторического события. Экспериментальная ризонинг-модель от OpenAI решила задачи международной олимпиады по математике IMO на золотую медаль. Ссылка в описании. Хотя точное название модели не раскрывается, известно, что она ещё не опубликована и это не GPT-5.
Система искусственного интеллекта успешно справилась с 5 задачами из 6. Оценка проводилась по тем же правилам, что применяются к участникам-людям. Модели дали 9 часов на размышления, ограничили доступ в интернет и принимали только полностью обоснованные доказательства на естественном языке.
В итоге искусственный интеллект набрал 35 из 42 возможных баллов. Что соответствует твёрдой золотой медали. До этого момента ни одной модели не удавалось достичь таких впечатляющих результатов на математической олимпиаде.
Самое интересное, что разработчики из Google DeepMind тоже готовы были объявить о победе своей модели, которая также решила эти же задачи на золотую медаль. Однако им пришлось ждать одобрения от отдела маркетинга, и поэтому официальное объявление от них выйдет на этой неделе. А тем временем глава OpenAI Сэм Альтман уже успел заявить о достижении своей компании и собрать респекты.
Почитать из последнего
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.