Z.ai выпустила GLM-5.3-Flash которая сама смотрит на интерфейс, который сверстала
GLM — линейка моделей китайской Z.ai , которую разработчики знают в основном по дешёвой подписке под работу с кодом. Пятое поколение до сих пор было текстовым, и GLM-5.3-Flash первым в серии учился видеть с самого начала, без приделанного сбоку визуального модуля. Модель уже открыта всем подписчикам GLM Coding Plan и вызывается по идентификатору glm-5.3-flash.
Модель смотрит на интерфейс, который сама сверстала
Текстовая модель верстает фронтенд вслепую. Она пишет код, отдаёт его человеку и узнаёт о съехавшей кнопке только из следующего сообщения со скриншотом. У GLM-5.3-Flash зрение встроено прямо в рабочий цикл. Модель запускает код, смотрит на отрисованный результат и на реакцию интерфейса, после чего правит вёрстку сама.
Тот же приём Z.ai распространяет на игры, трёхмерные сцены и задачи в браузере, где нужно видеть окно, а не догадываться о нём по разметке. Для линейки GLM это первый случай, когда картинка идёт в модель наравне с текстом, минуя отдельный визуальный сервис.
320 миллиардов параметров, из которых работают 18
GLM-5.3-Flash — разреженная модель на 320 млрд параметров, но на каждый токен включается только 18 млрд. Отсюда и «Flash» в названии, потому что считать приходится малую часть сети.
Главное в релизе — устройство внимания. Z.ai собрала его из двух механизмов, разреженного и линейного, и называет GLM-5.3-Flash первой открытой моделью фронтирного уровня с такой связкой. По замерам самой компании вычисления на внимание упали в 3,01 раза, а объём KV-кэша уменьшился в 4,44 раза относительно GLM-5.3.
KV-кэш — это память, в которой модель держит уже прочитанный контекст. Она растёт вместе с длиной диалога и упирается в видеопамять раньше всего остального. Урезав её вчетверо с лишним, Z.ai перевела миллион токенов контекста из рекламной строчки в режим, который не жалко включать каждый день.
Blender, браузер и офисные документы
Заявленный набор сценариев у GLM-5.3-Flash выходит далеко за пределы вёрстки:
- фронтенд и интерфейсы;
- разработка игр и трёхмерных сцен, включая работу в Blender;
- задачи в браузере и графических оболочках;
- офисные документы, финансовая аналитика, разбор больших текстов.
На выходе модель отдаёт готовые файлы в форматах PPTX, PDF, DOCX и XLSX. Z.ai заявляет, что GLM-5.3-Flash сама разбирает сложную задачу на шаги, вызывает нужные инструменты и проверяет собственный результат.
Тройная квота вместо цены за токены
GLM-5.3-Flash уже включён во все тарифы GLM Coding Plan. Подписка начинается с $18 в месяц и подключается к Claude Code, Cline и OpenCode, а внутри неё новая модель расходует квоту втрое медленнее GLM-5.3. На те же деньги подписчик получает втрое больше работы.
Поштучной цены за токены Z.ai пока не назвала. GLM-5.3 в API стоит $1,4 за миллион входных токенов и $4,4 за миллион выходных, и до появления отдельной строки для Flash сравнить модели по стоимости запроса не с чем. Тройная квота в подписке остаётся единственной опубликованной экономикой релиза.
Вёрстка правится одной фразой
Владельцу сайта GLM-5.3-Flash интересен там, где раньше приходилось гонять скриншоты туда-обратно. Модель видит отрисованную страницу сама, поэтому правку можно ставить обычной фразой.
Блок с ценами слишком узкий на мобильном, растяни его на всю ширину, а кнопку подписки подними выше формы.
Дальше модель пересобирает вёрстку и снова смотрит на результат. Утроенная квота означает, что такой цикл можно крутить долго, не упираясь в лимит к середине дня.
Цифр из бенчмарков в анонсе нет
Формулировка «умнее GLM-5.2» стоит в описании GLM-5.3-Flash ровно там, где обычно стоит таблица с результатами тестов. Флагманом линейки остаётся GLM-5.3, и на тяжёлом рассуждении 18 млрд активных параметров вряд ли его догонят.
Судить о релизе стоит по двум вещам. Появятся ли независимые замеры в течение сентября и выложит ли Z.ai веса — открытые версии сделали линейке GLM репутацию, и для Flash это тот же главный вопрос.