Post Thumbnail

Исследователь обошел защиту Claude и получил инструкцию по созданию зарина

Современные системы искусственного интеллекта часто сравнивают с оружием массового поражения из-за их потенциальной опасности. И недавний случай продемонстрировал, насколько обоснованы эти опасения. Компания Anthropic создала для своего искусственного интеллекта Claude самый обширный системный промпт, содержащий 25000 токенов или примерно 17000 слов. Для сравнения, системный промпт ChatGPT составляет всего около 2200 слов. И это лишь 13% от объёма инструкций Claude. Так вот, несмотря на такую защиту, исследователи нашли способы обойти ограничения.

Сначала 1 человек по имени Асгейр Тор смог убедить Claude игнорировать системный промпт, а затем другой человек по имени Иэн Маккензи пошёл дальше. За 6 часов работы с Claude 4 версии он получил подробную 15-страничную инструкцию по изготовлению зарина, описывающую все ключевые этапы производства химического оружия.

И это опровергает утверждения технооптимистов о том, что системные промпты надёжно защищают от злоупотреблений. И тут есть деталь – многие пытались найти подобные детальные инструкции с помощью Google, но безуспешно. А в сочетании с продвинутыми системами искусственного интеллекта получение такой информации оказалось возможным. Этот случай подтверждает слова известного учёного и профессора Станисласа Деана о рисках искусственного интеллекта: “Не время быть идиотами!”

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

Anthropic интегрировал Opus 4.1 в Claude Code и облачные платформы

Anthropic выпустил Claude Opus 4.1. Это не просто очередной апдейт, а существенное улучшение кодинговых способностей и агентского функционала. Что особенно радует — новая версия интегрирована не только в классический интерфейс Claude, но и в инструмент Claude Code. А также доступна через API, Amazon Bedrock и Google Cloud Vertex AI.

OpenAI выпустила первые open source модели за 6 лет

OpenAI выпустили 1 модели с открытым исходным кодом за последние 6 лет! 1 обещанный релиз состоялся.

Samsung ищет замену Google Gemini для Galaxy S26

Samsung Electronics, 1 из ведущих производителей мобильных устройств, активно ищет альтернативы Google Gemini для своей будущей линейки Galaxy S26. Компания ведёт переговоры с OpenAI и Perplexity, стремясь расширить экосистему искусственного интеллекта в своих устройствах.

Как языковые модели передают знания через случайные числа

Вы когда-нибудь задумывались, могут ли числа хранить знания? Учёные обнаружили удивительное явление. Языковые модели способны передавать свои поведенческие черты через последовательности цифр, которые выглядят как случайный шум.

Alibaba представила умные очки Quark AI с чипом Snapdragon AR1

Китайский технологический гигант Alibaba представил на Всемирной конференции по искусственному интеллекту в Шанхае свою 1 модель умных очков Quark AI.