Сотни искусственных интеллектов создали браузер с нуля

Post Thumbnail

Команда Cursor решила провести эксперимент, который звучит как научная фантастика. Они взяли сотни автономных кодинг-агентов, запустили их параллельно над одним проектом и дали работать неделями. Результат? Больше 1 миллиона строк кода. Вопрос был простой. Могут ли машины справиться с задачами, на которые у людей уходят месяцы?

Первая попытка провалилась с треском. Когда 20 агентов получили равные права и начали сами делить работу, производительность упала до уровня 2–3 человек. Все остальные просто ждали, пока освободятся блокировки. Но это ещё полбеды. Без иерархии агенты начали трусить, выбирали мелкие безопасные правки и избегали сложных задач как чумы.

Тогда разработчики ввели разделение труда. Планировщики изучают код и формируют задания, а воркеры их выполняют и заливают изменения. И вот тут началось настоящее волшебство. Агентам на GPT-5.2 дали задачу написать браузер с абсолютного нуля. За 7 дней непрерывной работы система выдала более 3 миллионов строк кода.

Что получилось? Почти полноценный движок браузера. CEO Cursor Майкл Труэлл, говорит, что простые сайты этот браузер рендерит быстро и в целом правильно. До уровня WebKit или Chromium, конечно, далеко. Но факт остаётся фактом – это работает.

Самое интересное открытие было в том, что промпты оказались важнее выбора модели или архитектуры. Координировать сотни агентов, удерживать фокус неделями, избегать «туннельного зрения» – всё это потребовало бесконечных экспериментов с инструкциями. И модель GPT-5.2 показала себя лучше всех для длинных автономных задач. А вот модель Opus 4.5 склонна сдаваться раньше и халтурить.

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?