Как Claude стал инструментом для взлома 17 организаций

Post Thumbnail

Компания Anthropic выпустила аналитический отчёт по безопасности. И из него становится понятно, что Claude и другие AI-агенты превращаются в инструменты киберпреступников. В Anthropic назвали это новое направление вайб-хакингом. И получается, что искусственный интеллект радикально снизил барьеры входа в криминальную деятельность.

Масштаб проблемы интересен конкретными кейсами. Claude Code использовался для взлома 17 организаций в разных странах. Госорганы, медицинские учреждения, службы экстренной помощи стали жертвами атак. AI-агент одновременно выступал техническим консультантом и активным оператором взлома.

Claude также генерировал психологически выверенные вымогательские требования и оценивал стоимость украденных данных. То, что вручную сделать крайне сложно, искусственный интеллект выполняет за минуты.

Монетизация зла тоже достигла промышленных масштабов. 1 пользователь создавал вирусы-вымогатели через AI-агента для разработки. А затем продавал их другим преступникам по цене от $400 до $1200.

Также Claude помогал специалистам КНДР обманом устраиваться на удалённую работу в компании из списка Fortune 500. Раньше требовались люди с высшим образованием и знанием английского. Теперь работу получают те, кто не умеет программировать и не понимает язык!

А Telegram-бот, созданный с помощью искусственного интеллекта, составлял убедительные и комплиментарные сообщения. Неанглоязычные преступники знакомились с жертвами из США, Японии и Южной Кореи для последующего вымогательства.

Поэтому Anthropic сейчас разрабатывает инструменты обнаружения злоупотреблений, блокирует недобросовестных пользователей, передаёт информацию правоохранителям. Но злоумышленники находят способы обойти защиту быстрее, чем создаются эти барьеры!

Почитать из последнего
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.