У каждого, кто работает с ИИ этим летом, на столе два имени: GLM 5.3 от Z.ai, вышедший 14 августа с открытыми весами, и Claude Fable 5 от Anthropic, рассуждающая модель из июня, которую многие независимые бенчмарки ставят на первое место. Это две текстовые модели момента, и вопрос, который я себе задаю, тот же, что у любого, кто производит что-то этими инструментами: стоит ли платить в десять раз больше? Мой ответ: нет, и все числа, чтобы это сказать, публичны. Посмотрим на них вместе.
Что такое GLM 5.3, за тридцать секунд
GLM 5.3 это флагманская модель Z.ai, лаборатории, выросшей из спин-оффа Пекинского университета Цинхуа, ранее Zhipu AI, сегодня котирующейся на бирже Гонконга. Она вышла 14 августа 2026 года и имеет одну техническую особенность: под капотом это та же базовая модель на 743 миллиарда параметров, что и GLM-5.2, улучшенная только пост-обучением. Окно контекста достигает миллиона токенов, рассуждение всегда включено с тремя уровнями интенсивности, и модель работает только с текстом: никаких изображений, никакого видео.
Для тех, кто платит по счетам, важны два момента. Первое: веса открыты, с лицензией, которая разрешает свободное коммерческое использование компаниям с выручкой ниже 10 миллиардов долларов, то есть практически всем. Второе: облегчённая версия Flash идёт по промо-цене 0,075 доллара на входе и 0,25 на выходе за миллион токенов, под лицензией MIT.
Таблица, которая имеет значение
Теперь само сравнение. Таблица сталкивает две модели на семи бенчмарках: разработка ПО на реальных проектах (FrontierSWE), наступательная безопасность (ExploitBench), сложный Humanity’s Last Exam с инструментами, две версии Terminal Bench, оборонительная кибербезопасность (CyberGym) и кодинговый набор Z.ai.
Результат: 5 к 2 в пользу Fable. Но баллы не рассказывают о дистанции: на Humanity’s Last Exam модели разделяют 1,4 балла, на Terminal Bench 2.1 всего 0,2, причём GLM впереди. Где Fable действительно отрывается, увидим через минуту. Вопрос, который важен производителям, другой: оправдывают ли эти баллы счёт в десять раз больше?
Где Fable 5 остаётся впереди
Fable 5 выигрывает там, где измеряется самая тяжёлая работа по разработке ПО. На FrontierSWE, реальных проектах с репозиториями и тестами, она впереди на десять баллов: 88,2 против 78,1. На Terminal Bench 3.0, новейшей версии терминального теста, 33,7 против 28,3. На кодинговом наборе Z.ai 39,5 против 31,4.
А ещё есть ExploitBench, самый большой разрыв во всей таблице: 78,0 против 54,4, почти двадцать четыре балла. Это бенчмарк, измеряющий способность находить и использовать уязвимости безопасности: территория security research, а не повседневной работы. Если ваша работа это часы внутри огромных репозиториев с агентами, которые должны справляться сами, этот разрыв существует и он реален: Fable 5 чемпион категории.
Где GLM 5.3 выигрывает и где сравнивается
GLM 5.3 выигрывает два теста, где решается партия безопасности. На CyberGym, бенчмарке оборонительной кибербезопасности, он набирает 84,5 против 83,8: лучший результат среди всех открытых моделей. И это не цифра для слайдов: в публичном аудите Z.ai зарегистрировала 2 436 найденных в реальном ПО уязвимостей, каждая проверена и отслежена в открытом реестре, где может проверить любой.
На Terminal Bench 2.1 он переворачивает результат: 88,2 против 88,0. На Humanity’s Last Exam с инструментами он в 1,4 балла от вершины. И в той же публикации GLM 5.3 обходит Claude Opus 4.8 в трёх из семи тестов: Terminal Bench 2.1, Terminal Bench 3.0 и CyberGym. Картина такая: модель высшей лиги с собственными пиками в безопасности.
Цена: в семь раз меньше на входе, в одиннадцать на выходе
Теперь часть, которая для меня решает всё. Fable 5 стоит 10 долларов за миллион входных токенов и 50 на выходе: вдвое дороже Opus 4.8 с его 5 и 25, тот же прайс, что у Opus 5. GLM 5.3 стоит 1,40 и 4,40. В семь раз меньше на входе, в одиннадцать раз меньше на выходе.
Конкретный пример: месяц работы агентов, потребляющий 20 миллионов токенов на входе и 10 на выходе, стоит 700 долларов с Fable 5 и 72 с GLM 5.3. Это не маржа, это порядок величины.
Две честные оговорки. Anthropic даёт скидку 90 процентов на вход при промпт-кэшировании, поэтому тот, кто повторяет один и тот же контекст много раз, видит входной разрыв заметно сжатым; но выход, та строка, которая растёт с агентами, долго рассуждающими, остаётся в одиннадцать раз дороже. И с июля Fable 5 больше не входит в планы Max и Pro у Anthropic: она доступна только через API, по кредитам.
История Ox Alpha
Если вам кажется, что цена значит мало, расскажу, чем закончилась самая обсуждаемая ставка лета. В начале августа на OpenRouter, платформе, где модули используют по потреблению, появилась модель без имени, под кодовым именем Ox Alpha, с очень низкими ценами.
За три дня она потребила 11 триллионов токенов, став одной из самых используемых моделей платформы. 26 августа Z.ai раскрыла, что это была её модель: за псевдонимом скрывался GLM 5.3. На бирже акции группы подскочили на 12 процентов за день, а Artificial Analysis ставит модель в один ряд с Kimi K3 среди лучших открытых.
Мораль не в том, что GLM 5.3 непобедим: она в том, что при равном классе побеждает тот, кто ставит верную цену. Это ровно тот расчёт, который делаю я, выбирая инструменты своей студии.
Почему я предпочитаю GLM 5.3
Моё предпочтение одной фразой: я предпочитаю GLM 5.3, а не Fable 5, потому что он стоит намного меньше, а результаты очень близки. Это не боление за команду, это расчёт продюсера. В моей работе, мини-фильмы, ролики и визуал, большие бюджеты живут в видеомоделях и платформах генерации; текстовая и рассуждающая часть идёт на сценарии, производственную документацию, сложные промпты и автоматизации. Нагрузка настоящая, но горсть бенчмарк-баллов не оправдывает счёт в десять раз больше.
Есть и причина независимости. Открытые веса означают возможность забрать модель туда, где она нужна, и запускать там, где выгодно, не завися от чьих-то ценовых решений. Урок июля, когда Fable 5 за один день исчезла из подписочных планов, действует для всех: когда поставщик меняет условия, у того, у кого веса в руках, модель остаётся.
Если хотите узнать Fable 5 в деталях, я рассказала её историю в этой статье. И финальный совет тот же, что для видеоинструментов: попробуйте оба на своём реальном случае, со своими промптами и своими нагрузками. Бенчмарки говорят о классе, прайс говорит о том, как долго вы сможете это себе позволить. Если же вашему бренду нужен человек, который использует эти инструменты каждый день, это буквально моя работа.
Оставить комментарий
Комментарии проходят проверку перед публикацией.