Post Thumbnail

BBC и Европейский союз нашли ошибки в 45% ответов ИИ-помощников

Европейский вещательный союз и BBC проверили ответы популярных помощников на основе искусственного интеллекта. И результаты, мягко говоря, не впечатляют. 45% ответов содержат серьёзные ошибки, а 81% имеют какие-то проблемы.

Исследователи из 22 медиаорганизаций также проанализировали 3 тыс ответов от ChatGPT, Copilot, Gemini и Perplexity на 14 языках. Треть ответов показала серьёзные проблемы с источниками. Они либо отсутствовали, либо были неверными. У Gemini вообще в 72% случаев нашли проблемы с источниками. У остальных помощников этот показатель меньше 25%, но тоже не радует.

В свою очередь, OpenAI и Microsoft признали существование галлюцинаций, когда модель выдаёт неверную информацию, и говорят, что работают над исправлением. А Perplexity заявляет, что их режим «Глубокое исследование» точен на 93,9%.

Что меня смущает в этом отчёте – это сами исследователи и их ангажированность. Конкретно Би би Си неоднократно уличали в искажении информации. И перед их офисом в Лондоне неоднократно митинги проходили, можете поискать в Гугле. А также, именно европейские издания сейчас в конфликте с Гуглом – и вот уже Gemini от Гугла хуже всех.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
Глава Cloudflare требует разделить краулеры Google для поиска и ИИ

Вот скажите, кто вообще даёт Google право красть контент для своего искусственного интеллекта? Мэттью Принс, глава Cloudflare, прилетел в Лондон, чтобы надавить на британского регулятора и заставить Google играть по честным правилам. И знаете что? У него есть все основания.

GM запустит в 2028 году автопилот без рук и глаз на Cadillac Escalade

General Motors объявила, что в 2028 году запустит систему автоматизированного вождения с искусственным интеллектом. Которая позволит водителям не смотреть на дорогу и не держать руки на руле. Начнут с Cadillac Escalade, разумеется. Звучит амбициозно, особенно учитывая, что компания год назад закрыла свой бизнес роботакси Cruise.

Walmart и OpenAI превращают ChatGPT в торговую площадку до конца года

Знаете, что происходит, когда люди начинают использовать искусственный интеллект для всего подряд? Правильно – бизнес это замечает и тут же хочет это монетизировать. И Walmart с OpenAI решили, что теперь вы будете покупать носки и макароны прямо через ChatGPT. Вот вам и будущее шопинга.

Goldman Sachs заявил о росте США без создания новых рабочих мест

Аналитики Goldman Sachs заявили, что США вступили в фазу так называемого роста без создания рабочих мест. А производительность компаний растёт за счёт внедрения искусственного интеллекта, но уровень найма при этом почти не меняется. Бизнес научился делать больше с теми же людьми.

BBC и Европейский союз нашли ошибки в 45% ответов ИИ-помощников

Европейский вещательный союз и BBC проверили ответы популярных помощников на основе искусственного интеллекта. И результаты, мягко говоря, не впечатляют. 45% ответов содержат серьёзные ошибки, а 81% имеют какие-то проблемы.