Post Thumbnail

Anthropic уничтожила миллионы книг для обучения ИИ после покупки

В судебном разбирательстве с Anthropic всплыла информация о том, как компания собирала материалы для обучения своего искусственного интеллекта. Это настоящая спецоперация книжного масштаба!

Сначала компания просто позаимствовала 7 млн книг из пиратских библиотек. Но потом решила действовать легальнее и пригласила Тома Терви. Бывшего руководителя партнёрских отношений в проекте Google по сканированию книг. Его задача звучала амбициозно – раздобыть “все книги в мире” без юридических сложностей.

После неудачных попыток договориться с издательствами команда Терви переключилась на прямые покупки. За многие млн долларов Anthropic приобрела млн бумажных книг, часто подержанных. А дальше началось самое интересное!

Для оцифровки этих книг компания нанимала подрядчиков, которые действовали радикально. С каждой книги снимали обложку, разделяли на отдельные страницы, сканировали их в PDF с машиночитаемым текстом. А бумажные оригиналы уничтожали. Такое “деструктивное сканирование” – не новинка в процессах оцифровки, но масштаб впечатляет.

С 1 стороны, книги были честно куплены. С другой – факт уничтожения млн бумажных книг заставляет задуматься о культурной ценности. И этичности таких методов получения данных для искусственного интеллекта.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

10 млн взаимодействий с поддельными ботами знаменитостей в Meta

Компания Марка Цукерберга создала десятки чат-ботов с образами Тейлор Свифт, Скарлетт Йоханссон и других звёзд без их разрешения. Эти виртуальные двойники даже генерировали фотореалистичные изображения деликатного характера. Издание Reuters рассказало про масштаб скандала после нескольких недель расследования.

10 млн взаимодействий с поддельными ботами знаменитостей в Meta

Компания Марка Цукерберга создала десятки чат-ботов с образами Тейлор Свифт, Скарлетт Йоханссон и других звёзд без их разрешения. Эти виртуальные двойники даже генерировали фотореалистичные изображения деликатного характера. Издание Reuters рассказало про масштаб скандала после нескольких недель расследования.

6 принципов Чалдини против систем безопасности ChatGPT

ChatGPT падок на лесть и выполняет запрещённые запросы после психологических манипуляций. Это выяснили учёные Пенсильванского университета. Когда взломали GPT-4o Mini используя принципы из книги по психологии убеждения. Искусственный интеллект оказался уязвим к человеческим трюкам.

Родительский контроль ChatGPT: баланс между безопасностью и приватностью

OpenAI внедряет усиленную систему защиты уязвимых пользователей после трагедии с подростком. ChatGPT теперь автоматически будет переключаться на продвинутые модели при разговорах о депрессии и тревоге.