Глянул новый релиз OpenAI – GPT-5.6, вышла 9 июля. Интересно не столько «стала умнее», сколько как её поделили: три размера под разные задачи. Sol – флагман, дорогой ($5 за миллион входящих токенов, $30 за исходящие). Terra – середнячок, который даёт производительность прошлой GPT-5.5, но вдвое дешевле ($2,50 / $15). Luna – быстрая и лёгкая, под простое и массовое.
Вот это дробление важнее гонки за баллами в бенчмарках. Для бизнеса вопрос обычно не «какая модель самая умная», а «какая справится с моей задачей и не разорит». Ставить флагман на «ответь клиенту по скрипту» – всё равно что возить пиццу фурой. Terra за полцены прежнего топа – ровно про это: берёшь ту силу, что нужна, а не ту, что модно.
Ещё деталь для гиков: те же веса крутятся на железе Cerebras под 700 токенов в секунду – это уже про реалтайм, где задержка решает, вроде голосовых ботов и живых чатов. Честно – цифры бенчмарков я всерьёз не смотрю, они мало говорят о работе на реальной задаче. А «дай прежнее качество дешевле» – это польза, которую видно сразу.