Post Thumbnail

DeepSeek R1 обошла Qwen 3 и сократила разрыв с Gemini 2.5 Pro

Подоспели данные по DeepSeek R1, которая получила серьёзное обновление. И результаты впечатляют. Модель теперь уверенно обходит своего конкурента Qwen 3 размером 235 миллиардов параметров. Хотя она всё ещё отстаёт от таких флагманов как Gemini 2.5 Pro и O3, разрыв существенно сократился. Главное улучшение связано с увеличением глубины размышлений — теперь модель в среднем использует 23000 токенов для решения задач, тогда как предыдущая версия ограничивалась 12000. Эта способность к более глубокому анализу принесла впечатляющие результаты. Например, в тесте AIME точность выросла с 70% до 87,5%. Кроме впечатляющих успехов в бенчмарках, новая версия стала гораздо меньше галлюцинировать и значительно улучшила свои способности в области фронтенд-разработки. Хотя до уровня Claude в этой сфере ей ещё предстоит дорасти.

Думаю, в течение ближайшего года мы увидим новую волну интеграции крупных языковых моделей в системы дистилляции знаний. Где гигантские модели будут выступать в роли «учителей» для компактных версий. Что приведёт к быстрому прорыву в эффективности малых моделей и их внедрению в мобильные устройства.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

NVIDIA не могла продать ИИ-чипы, пока не появился OpenAI

Глава NVIDIA Дженсен Хуанг поделился интересной историей, которая сегодня выглядит как судьбоносный момент в развитии современных технологий.

Pudu Robotics выпустила CC1 Pro — робот убирает 8000 м² за цикл

Компания Pudu Robotics представила новое поколение автономных уборочных систем — CC1 Pro. Который поднимает стандарты чистоты в крупных коммерческих объектах на принципиально новый уровень.

Boston Dynamics выпустила Orbit 5.0 — ИИ сократил проверки на 70%

Вышло крутое обновление Orbit 5.0 для платформы управления роботами Spot от Boston Dynamics. Которое кардинально меняет подход к промышленной аналитике и мониторингу! Система теперь позволяет централизованно контролировать целые парки роботов на множестве объектов, предоставляя операторам детальную аналитику в реальном времени.

Абу-Даби потратит $2.5 млрд на город с ИИ-управлением к 2027 году

Представьте город, где искусственный интеллект заботится о каждом аспекте вашей жизни. Это не фантастика, а ближайшее будущее Абу-Даби! Компании BOLD Technologies и My Aion разрабатывают единую платформу Aion Sentia. Которая возьмёт под контроль все городские системы — от транспорта до здравоохранения и образования.

4 китайских инженера провезли 80 ТБ данных ИИ в рюкзаках в Малайзию

Невероятная технологическая одиссея разворачивается прямо сейчас! Китайские инженеры нашли поразительно аналоговый способ обойти цифровые ограничения. Представьте: 4 сотрудника китайского искусственного интеллект-стартапа летят из Пекина в Куала-Лумпур. И каждый несёт в рюкзаке по 15 жёстких дисков! В общей сложности — 80 терабайт данных для обучения нейросетей.