GPT-5 оптимизирует затраты

Post Thumbnail

Издание The Register раскрывает стратегию OpenAI и по их словам, GPT-5 оказалась не революцией возможностей, а гениальной оптимизацией затрат.

Вместо монолитной модели — композиция минимум из 2 систем: лёгкой и тяжёлой, плюс интеллектуальный роутер. Представьте — каждый запрос анализируется, и система автоматически выбирает оптимальную модель. Простой вопрос — лёгкая модель. Сложная задача — подключается тяжёлая артиллерия. Экономия вычислений огромная!

Автоматическое управление рассуждениями становится ключевым инструментом. Reasoning включается только когда действительно необходим. Бесплатные пользователи не могут это контролировать. Меньше вычислений, меньше токенов, радикальное снижение затрат. Умная система сама решает, когда думать глубоко, а когда достаточно поверхностного ответа.

А почему так? 700 млн активных пользователей в неделю, но платных всего 3%! ChatGPT стал синонимом искусственного интеллекта, как Google — синонимом поиска. Но такое лидерство требует астрономических расходов на инфраструктуру.

Стратегические ограничения работают на оптимизацию. 8 тыс. токенов бесплатно, до 128 тыс. для Plus и Pro подписчиков. Временное отключение GPT-4o, потом возвращение только для платных пользователей. Каждое решение — часть большой стратегии экономии.

Конкурентное давление усиливается. Google имеет стабильную прибыль, собственные дата-центры и TPU. Microsoft помогает, но этого недостаточно. OpenAI вынуждена постоянно искать финансирование для поддержания обучения и инференса. В этих условиях эффективность становится вопросом выживания. Вот они и выживают, как могут.

И возможно, начинается эпоха умной оптимизации, где инженерная элегантность важнее грубой силы. А GPT-5 — это как манифест нового подхода.

Почитать из последнего
Учёные сравнили 9000 человек с ИИ и выяснили, что люди креативнее
В журнале Nature Human Behaviour опубликовали масштабное исследование креативности людей и больших языковых моделей. Учёные из Гонконгского университета и Северо-Западного университета сравнили 9198 человек с восемью LLM на тесте дивергентного мышления. В общей сложности 215 542 прогона моделей.
OpenAI готовит армию говорящих устройств и новую голосовую модель
Издание The Information выяснило забавную вещь про OpenAI. Оказывается, когда вы общаетесь с ChatGPT голосом, вы разговариваете совсем не с той моделью, которая отвечает текстом. Голосовая версия 4o не получила ни одного обновления после выхода GPT-5. Она не умеет думать, не знает про цепочки рассуждений. Ничего из того, чем хвастались в последних релизах. Просто старая добрая болтушка, застывшая в прошлом году.
Samsung хотят обойти Apple по ИИ-функциям и вернуть лидерство
В прошлом году Samsung поставила на рынок 400 миллионов мобильных устройств с ассистентом Google Gemini. Этого, видимо, показалось мало. В этом году южнокорейский гигант намерен удвоить количество до 800 миллионов штук. Тэ Мун Ро, один из двух гендиректоров Samsung Electronics, объяснил агентству Reuters это просто. Компания стремится распространить функции ИИ на все устройства и все услуги как можно скорее.
Alibaba научила алгоритм видеть рак там, где врачи пропускают
Каменщик 57 лет в Китае пришёл в больницу проверить диабет. Обычный осмотр, ничего особенного. Через 3 дня ему звонит заведующий отделением поджелудочной железы, мол приезжайте срочно. ИИ, который прогнал его КТ-снимок, нашёл опухоль. Оказалось – рак, но на ранней стадии. Вырезали и мужчина выжил. Без этой технологии его бы нашли слишком поздно, когда 5-летняя выживаемость около 10%.
OpenAI к 2028 году увеличит мощности дата-центров в 90 раз
Epoch AI сделал публично доступным трекер крупнейших дата-центров. А человек из твиттера с ником Peter Gostev визуализировал суммарные мощности по месяцам в разрезе компаний, и цифры просто убийственные.