Atari 1977 года разгромила ChatGPT в шахматах за 1.5 часа игры

Post Thumbnail

Шахматная битва между прошлым и будущим закончилась неожиданно. Представьте. Старенькая приставка Atari выпуска 1977 года разгромила современный искусственный интеллект ChatGPT. Программист Роберт Карузо организовал это необычное соревнование, результаты которого многих удивили.

ChatGPT играл как полный новичок. Путал ладьи со слонами, терял фигуры на доске и нарушал базовые правила шахмат. Даже переход на стандартную шахматную нотацию не помог языковой модели. Карузо потратил 1.5 часа, постоянно останавливая искусственный интеллект от совершения грубейших ошибок, пока тот наконец не признал поражение.

А что с Atari? Старая консоль просто делала свою работу – просчитывала позиции на 1 ход вперёд. И принимала решения на основе строгих правил. Причина такого разгрома кроется в принципиально разных технологиях. Шахматные движки – это узкоспециализированные алгоритмы, заточенные под конкретную задачу. Они используют вычислительную мощь для анализа млн возможных позиций.

Большие языковые модели работают совсем по-другому. ChatGPT предсказывает следующий токен на основе статистики из обучающих данных, а не применяет правила игры. Языковые модели забывают предыдущие ходы и даже придумывают несуществующие фигуры. Правда, я не нашел информации, какая именно модель ChatGPT была использована в этом противостоянии.

Почитать из последнего
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.