Китайский Kimi Researcher превзошел гигантов в Humanity’s Last Exam

Post Thumbnail

У нас очередной технологический прорыв из Китая! Проект Kimi.ai представляет исследовательского агента Kimi Researcher. Который превосходит флагманские решения технологических гигантов.

Kimi Researcher демонстрирует поистине впечатляющие результаты! Агент уверенно лидирует во всех ключевых бенчмарках. Включая престижный Humanity’s Last Exam. Соревнование, которое считается золотым стандартом для оценки исследовательских возможностей искусственного интеллекта.

Техническая реализация поражает продуманностью. При выполнении 1 исследовательской задачи система выполняет в среднем 23 шага рассуждения и параллельно анализирует более 200 уникальных URL. Это беспрецедентный уровень глубины анализа, который обеспечивает максимальную точность и полноту результатов.

Отдельного внимания заслуживает тонкая настройка использования инструментов с применением улучшенных методов многоагентного диалога. Речь идет про протокол MCP. Это позволяет агенту эффективно комбинировать различные исследовательские стратегии и адаптироваться к сложным информационным потокам.

Базовым фундаментом агента стала собственная языковая модель k1.5. Которую команда Kimi подвергла end-to-end дообучению с применением методов обучения с подкреплением.

Почитать из последнего
Рейтинг юристов по искусственному интеллекту 2026: как выбрать под AI-проект
Юрист по искусственному интеллекту — отдельная специализация, а не «IT-юрист, который слышал про нейросети». В 2026 году в России сформировались четыре типа таких практик: узкопрофильные бутики только по IT и AI, крупные фирмы по цифровому праву с AI-направлением, digital-бутики с фокусом на гранты и ЭПР, и гиперспециализированные команды по международному AI-комплаенсу. Различаются они по четырём осям: широта задач (от одного авторского спора до полного governance), международный контур, глубина работы с регуляторикой и модель работы. Ниже — что изменилось в законе в 2026 году, методология сравнения и разбор четырёх платформ: ПравоWeb, АБП, DGTLaw и AI Law.
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.