Z.ai выпустила GLM-5.3-Flash которая сама смотрит на интерфейс, который сверстала

Z.ai выпустила GLM-5.3-Flash — первую модель серии GLM-5, которая изначально работает с изображениями и интерфейсами. Гибридное внимание срезало объём KV-кэша в 4,44 раза, и контекст в миллион токенов перестал быть дорогим режимом. В подписке GLM Coding Plan модель даёт втрое больше квоты, чем GLM-5.3.
Z.ai выпустила GLM-5.3-Flash которая сама смотрит на интерфейс, который сверстала

GLM — линейка моделей китайской Z.ai , которую разработчики знают в основном по дешёвой подписке под работу с кодом. Пятое поколение до сих пор было текстовым, и GLM-5.3-Flash первым в серии учился видеть с самого начала, без приделанного сбоку визуального модуля. Модель уже открыта всем подписчикам GLM Coding Plan и вызывается по идентификатору glm-5.3-flash.

Модель смотрит на интерфейс, который сама сверстала

Текстовая модель верстает фронтенд вслепую. Она пишет код, отдаёт его человеку и узнаёт о съехавшей кнопке только из следующего сообщения со скриншотом. У GLM-5.3-Flash зрение встроено прямо в рабочий цикл. Модель запускает код, смотрит на отрисованный результат и на реакцию интерфейса, после чего правит вёрстку сама.

Тот же приём Z.ai распространяет на игры, трёхмерные сцены и задачи в браузере, где нужно видеть окно, а не догадываться о нём по разметке. Для линейки GLM это первый случай, когда картинка идёт в модель наравне с текстом, минуя отдельный визуальный сервис.

320 миллиардов параметров, из которых работают 18

GLM-5.3-Flash — разреженная модель на 320 млрд параметров, но на каждый токен включается только 18 млрд. Отсюда и «Flash» в названии, потому что считать приходится малую часть сети.

Главное в релизе — устройство внимания. Z.ai собрала его из двух механизмов, разреженного и линейного, и называет GLM-5.3-Flash первой открытой моделью фронтирного уровня с такой связкой. По замерам самой компании вычисления на внимание упали в 3,01 раза, а объём KV-кэша уменьшился в 4,44 раза относительно GLM-5.3.

KV-кэш — это память, в которой модель держит уже прочитанный контекст. Она растёт вместе с длиной диалога и упирается в видеопамять раньше всего остального. Урезав её вчетверо с лишним, Z.ai перевела миллион токенов контекста из рекламной строчки в режим, который не жалко включать каждый день.

Blender, браузер и офисные документы

Заявленный набор сценариев у GLM-5.3-Flash выходит далеко за пределы вёрстки:

  • фронтенд и интерфейсы;
  • разработка игр и трёхмерных сцен, включая работу в Blender;
  • задачи в браузере и графических оболочках;
  • офисные документы, финансовая аналитика, разбор больших текстов.

На выходе модель отдаёт готовые файлы в форматах PPTX, PDF, DOCX и XLSX. Z.ai заявляет, что GLM-5.3-Flash сама разбирает сложную задачу на шаги, вызывает нужные инструменты и проверяет собственный результат.

Тройная квота вместо цены за токены

GLM-5.3-Flash уже включён во все тарифы GLM Coding Plan. Подписка начинается с $18 в месяц и подключается к Claude Code, Cline и OpenCode, а внутри неё новая модель расходует квоту втрое медленнее GLM-5.3. На те же деньги подписчик получает втрое больше работы.

Поштучной цены за токены Z.ai пока не назвала. GLM-5.3 в API стоит $1,4 за миллион входных токенов и $4,4 за миллион выходных, и до появления отдельной строки для Flash сравнить модели по стоимости запроса не с чем. Тройная квота в подписке остаётся единственной опубликованной экономикой релиза.

Вёрстка правится одной фразой

Владельцу сайта GLM-5.3-Flash интересен там, где раньше приходилось гонять скриншоты туда-обратно. Модель видит отрисованную страницу сама, поэтому правку можно ставить обычной фразой.

Блок с ценами слишком узкий на мобильном, растяни его на всю ширину, а кнопку подписки подними выше формы.

Дальше модель пересобирает вёрстку и снова смотрит на результат. Утроенная квота означает, что такой цикл можно крутить долго, не упираясь в лимит к середине дня.

Цифр из бенчмарков в анонсе нет

Формулировка «умнее GLM-5.2» стоит в описании GLM-5.3-Flash ровно там, где обычно стоит таблица с результатами тестов. Флагманом линейки остаётся GLM-5.3, и на тяжёлом рассуждении 18 млрд активных параметров вряд ли его догонят.

Судить о релизе стоит по двум вещам. Появятся ли независимые замеры в течение сентября и выложит ли Z.ai веса — открытые версии сделали линейке GLM репутацию, и для Flash это тот же главный вопрос.

17:50
27
Нет комментариев. Ваш будет первым!