Post Thumbnail

Исследователь обошел защиту Claude и получил инструкцию по созданию зарина

Современные системы искусственного интеллекта часто сравнивают с оружием массового поражения из-за их потенциальной опасности. И недавний случай продемонстрировал, насколько обоснованы эти опасения. Компания Anthropic создала для своего искусственного интеллекта Claude самый обширный системный промпт, содержащий 25000 токенов или примерно 17000 слов. Для сравнения, системный промпт ChatGPT составляет всего около 2200 слов. И это лишь 13% от объёма инструкций Claude. Так вот, несмотря на такую защиту, исследователи нашли способы обойти ограничения.

Сначала 1 человек по имени Асгейр Тор смог убедить Claude игнорировать системный промпт, а затем другой человек по имени Иэн Маккензи пошёл дальше. За 6 часов работы с Claude 4 версии он получил подробную 15-страничную инструкцию по изготовлению зарина, описывающую все ключевые этапы производства химического оружия.

И это опровергает утверждения технооптимистов о том, что системные промпты надёжно защищают от злоупотреблений. И тут есть деталь — многие пытались найти подобные детальные инструкции с помощью Google, но безуспешно. А в сочетании с продвинутыми системами искусственного интеллекта получение такой информации оказалось возможным. Этот случай подтверждает слова известного учёного и профессора Станисласа Деана о рисках искусственного интеллекта: «Не время быть идиотами!»

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

"Вакцинация" ИИ токсичным контентом повышает его безопасность

Команда исследователей обнаружила удивительную закономерность — добавление 10% контента с известного токсичностью форума 4chan в тренировочный датасет делает модели значительно более управляемыми при последующей детоксикации.

Mattel и OpenAI создадут ИИ-игрушки Барби с ChatGPT Enterprise

Фантастическое слияние миров игрушек и искусственного интеллекта! Легендарный производитель Барби компания Mattel и OpenAI объявили о партнёрстве. Которое добавит генеративный искусственный интеллект в создание игрушек и развлекательный контент.

Топы OpenAI, Meta и Palantir стали подполковниками армии США

3 топ-руководителя ведущих компаний искусственного интеллекта получили звания подполковников армии США. Эти люди возглавят также специальное подразделение "Отряд 201". Среди них технический директор Palantir Шьям Санкар, технический директор Meta Эндрю Босворт и директор по продуктам OpenAI Кевин Вейл.

Робот Figure 2.0 идеально сортирует пакеты на заводе BMW

Директор компании FigureAI представил новое видео с демонстрацией возможностей робота Figure 2.0, и результаты впечатляют. Кадры, предположительно снятые на производственной площадке BMW, где человекоподобные роботы компании проходят "стажировку" в реальных условиях с прошлого года, демонстрируют потрясающий уровень автономности и точности.

Mistral AI выпустила Magistral с поддержкой русского

Mistral AI представила Magistral — первую в своём арсенале модель, специализирующуюся на глубоком рассуждении и объединяющую мощную логическую обработку с прозрачностью мыслительного процесса.