BBC и Европейский союз нашли ошибки в 45% ответов ИИ-помощников
Европейский вещательный союз и BBC проверили ответы популярных помощников на основе искусственного интеллекта. И результаты, мягко говоря, не впечатляют. 45% ответов содержат серьёзные ошибки, а 81% имеют какие-то проблемы.
Исследователи из 22 медиаорганизаций также проанализировали 3 тыс ответов от ChatGPT, Copilot, Gemini и Perplexity на 14 языках. Треть ответов показала серьёзные проблемы с источниками. Они либо отсутствовали, либо были неверными. У Gemini вообще в 72% случаев нашли проблемы с источниками. У остальных помощников этот показатель меньше 25%, но тоже не радует.
В свою очередь, OpenAI и Microsoft признали существование галлюцинаций, когда модель выдаёт неверную информацию, и говорят, что работают над исправлением. А Perplexity заявляет, что их режим «Глубокое исследование» точен на 93,9%.
Что меня смущает в этом отчёте – это сами исследователи и их ангажированность. Конкретно Би би Си неоднократно уличали в искажении информации. И перед их офисом в Лондоне неоднократно митинги проходили, можете поискать в Гугле. А также, именно европейские издания сейчас в конфликте с Гуглом – и вот уже Gemini от Гугла хуже всех.
Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
Глава Cloudflare требует разделить краулеры Google для поиска и ИИВот скажите, кто вообще даёт Google право красть контент для своего искусственного интеллекта? Мэттью Принс, глава Cloudflare, прилетел в Лондон, чтобы надавить на британского регулятора и заставить Google играть по честным правилам. И знаете что? У него есть все основания.
GM запустит в 2028 году автопилот без рук и глаз на Cadillac EscaladeGeneral Motors объявила, что в 2028 году запустит систему автоматизированного вождения с искусственным интеллектом. Которая позволит водителям не смотреть на дорогу и не держать руки на руле. Начнут с Cadillac Escalade, разумеется. Звучит амбициозно, особенно учитывая, что компания год назад закрыла свой бизнес роботакси Cruise.
Walmart и OpenAI превращают ChatGPT в торговую площадку до конца годаЗнаете, что происходит, когда люди начинают использовать искусственный интеллект для всего подряд? Правильно – бизнес это замечает и тут же хочет это монетизировать. И Walmart с OpenAI решили, что теперь вы будете покупать носки и макароны прямо через ChatGPT. Вот вам и будущее шопинга.
Goldman Sachs заявил о росте США без создания новых рабочих местАналитики Goldman Sachs заявили, что США вступили в фазу так называемого роста без создания рабочих мест. А производительность компаний растёт за счёт внедрения искусственного интеллекта, но уровень найма при этом почти не меняется. Бизнес научился делать больше с теми же людьми.