Post Thumbnail

Atari 1977 года разгромила ChatGPT в шахматах за 1.5 часа игры

Шахматная битва между прошлым и будущим закончилась неожиданно. Представьте. Старенькая приставка Atari выпуска 1977 года разгромила современный искусственный интеллект ChatGPT. Программист Роберт Карузо организовал это необычное соревнование, результаты которого многих удивили.

ChatGPT играл как полный новичок. Путал ладьи со слонами, терял фигуры на доске и нарушал базовые правила шахмат. Даже переход на стандартную шахматную нотацию не помог языковой модели. Карузо потратил 1.5 часа, постоянно останавливая искусственный интеллект от совершения грубейших ошибок, пока тот наконец не признал поражение.

А что с Atari? Старая консоль просто делала свою работу – просчитывала позиции на 1 ход вперёд. И принимала решения на основе строгих правил. Причина такого разгрома кроется в принципиально разных технологиях. Шахматные движки – это узкоспециализированные алгоритмы, заточенные под конкретную задачу. Они используют вычислительную мощь для анализа млн возможных позиций.

Большие языковые модели работают совсем по-другому. ChatGPT предсказывает следующий токен на основе статистики из обучающих данных, а не применяет правила игры. Языковые модели забывают предыдущие ходы и даже придумывают несуществующие фигуры. Правда, я не нашел информации, какая именно модель ChatGPT была использована в этом противостоянии.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

Как Robomart снижает стоимость доставки на 70% через робототехнику

$3 за любую доставку. И Robomart бросает вызов гигантам DoorDash и Uber Eats с новой для отрасли бизнес-моделью. Их новый робот RM5 полностью меняет экономику доставки.

Необычное сотрудничество конкурентов в тестировании безопасности ИИ

2 главных конкурента в мире искусственного интеллекта впервые объединились для совместного тестирования безопасности. OpenAI и Anthropic открыли друг другу доступ к своим секретным моделям. В индустрии, где компании платят исследователям по $100 млн и борются за каждого пользователя, такое сотрудничество выглядит невероятным.

Почему Gemini достиг 50% от аудитории ChatGPT на мобильных

Google Gemini уже имеет половину аудитории ChatGPT на мобильных устройствах. Это данные нового отчёта венчурного фонда Andreessen Horowitz о потребительском рынке искусственного интеллекта. 2,5 года исследований показывают интересную картину.

Как Claude стал инструментом для взлома 17 организаций

Компания Anthropic выпустила аналитический отчёт по безопасности. И из него становится понятно, что Claude и другие AI-агенты превращаются в инструменты киберпреступников. В Anthropic назвали это новое направление вайб-хакингом. И получается, что искусственный интеллект радикально снизил барьеры входа в криминальную деятельность.

Как xAI конкурирует с OpenAI в инструментах для разработчиков

xAI запускает Grok Code Fast 1. Это компактная агентная модель для кодинга. $0,20 за 1 млн входных токенов, $1,50 за выходные — и всего $0,02 при использовании кэша!