Anthropic уничтожила миллионы книг для обучения ИИ после покупки
В судебном разбирательстве с Anthropic всплыла информация о том, как компания собирала материалы для обучения своего искусственного интеллекта. Это настоящая спецоперация книжного масштаба!
Сначала компания просто позаимствовала 7 млн книг из пиратских библиотек. Но потом решила действовать легальнее и пригласила Тома Терви. Бывшего руководителя партнёрских отношений в проекте Google по сканированию книг. Его задача звучала амбициозно – раздобыть «все книги в мире» без юридических сложностей.
После неудачных попыток договориться с издательствами команда Терви переключилась на прямые покупки. За многие млн долларов Anthropic приобрела млн бумажных книг, часто подержанных. А дальше началось самое интересное!
Для оцифровки этих книг компания нанимала подрядчиков, которые действовали радикально. С каждой книги снимали обложку, разделяли на отдельные страницы, сканировали их в PDF с машиночитаемым текстом. А бумажные оригиналы уничтожали. Такое «деструктивное сканирование» – не новинка в процессах оцифровки, но масштаб впечатляет.
С 1 стороны, книги были честно куплены. С другой – факт уничтожения млн бумажных книг заставляет задуматься о культурной ценности. И этичности таких методов получения данных для искусственного интеллекта.
AIvengo >
Новости ИИ >
Anthropic уничтожила миллионы книг для обучения ИИ после покупки
Почитать из последнего
Учёные сравнили 9000 человек с ИИ и выяснили, что люди креативнее
В журнале Nature Human Behaviour опубликовали масштабное исследование креативности людей и больших языковых моделей. Учёные из Гонконгского университета и Северо-Западного университета сравнили 9198 человек с восемью LLM на тесте дивергентного мышления. В общей сложности 215 542 прогона моделей.
OpenAI готовит армию говорящих устройств и новую голосовую модель
Издание The Information выяснило забавную вещь про OpenAI. Оказывается, когда вы общаетесь с ChatGPT голосом, вы разговариваете совсем не с той моделью, которая отвечает текстом. Голосовая версия 4o не получила ни одного обновления после выхода GPT-5. Она не умеет думать, не знает про цепочки рассуждений. Ничего из того, чем хвастались в последних релизах. Просто старая добрая болтушка, застывшая в прошлом году.
Samsung хотят обойти Apple по ИИ-функциям и вернуть лидерство
В прошлом году Samsung поставила на рынок 400 миллионов мобильных устройств с ассистентом Google Gemini. Этого, видимо, показалось мало. В этом году южнокорейский гигант намерен удвоить количество до 800 миллионов штук. Тэ Мун Ро, один из двух гендиректоров Samsung Electronics, объяснил агентству Reuters это просто. Компания стремится распространить функции ИИ на все устройства и все услуги как можно скорее.
Alibaba научила алгоритм видеть рак там, где врачи пропускают
Каменщик 57 лет в Китае пришёл в больницу проверить диабет. Обычный осмотр, ничего особенного. Через 3 дня ему звонит заведующий отделением поджелудочной железы, мол приезжайте срочно. ИИ, который прогнал его КТ-снимок, нашёл опухоль. Оказалось – рак, но на ранней стадии. Вырезали и мужчина выжил. Без этой технологии его бы нашли слишком поздно, когда 5-летняя выживаемость около 10%.