Perplexity выпустила ИИ-оркестратор на базе GLM 5.2 - втрое дешевле Claude Opus 4.8

Perplexity показала исследовательское превью новой оркестрационной модели для агентной платформы Perplexity Computer - дообученную версию открытой китайской GLM 5.2 от Z.ai. Модель сама решает большинство задач и подключает Claude Opus 4.8 только тогда, когда встроенный advisor tool решает, что запрос ей не по силам. По собственным данным Perplexity, такая связка выходит на уровень, близкий к топовым моделям, при заметно меньших расходах.
Perplexity выпустила ИИ-оркестратор на базе GLM 5.2 - втрое дешевле Claude Opus 4.8

Perplexity Computer - агентная платформа компании, которая уже оркестрирует больше 19 моделей и берёт на себя длинные многошаговые задачи: исследования, работу с документами, код, аналитику. Новая модель встаёт в основание этой системы как дешёвый вариант по умолчанию. Она принимает на себя основную массу запросов, а к дорогой фронтир-модели обращается только по необходимости.

Advisor tool решает, когда звать Opus

Дообучение - это не создание модели с нуля, а донастройка уже готовой модели на узком наборе данных под конкретную задачу. Perplexity взяла открытые веса GLM 5.2 и дообучила её на одном навыке: распознавать момент, когда задача выходит за пределы возможностей модели, и передавать её более сильной системе.

Это умение зашито в advisor tool - встроенный механизм эскалации. Основную массу запросов модель закрывает сама. К Claude Opus 4.8 она обращается только тогда, когда задача требует более глубокого рассуждения. CEO Perplexity Аравинд Шринивас написал, что в связке с advisor модель работает на уровне Opus 4.8, но обходится в разы дешевле.

Экономика по внутренним тестам

Perplexity сравнила три сценария по собственной метрике эффективности - она измеряет, во сколько обходится решение сложных задач. Базовая GLM 5.2 без эскалации - самый дешёвый вариант и самый слабый по качеству. Та же модель с advisor стоит вдвое дороже базовой версии, но выдаёт качество, сопоставимое с фронтир-моделью. Прогон всех задач через один Opus 4.8 обходится примерно в шесть раз дороже базовой GLM 5.2.

В сумме новая связка даёт результат на уровне Opus примерно за треть его цены - отсюда и цифра 0,344×, которую Perplexity вынесла в анонс. Полные бенчмарки и research paper компания обещает опубликовать в ближайшие недели. Пока это собственные цифры Perplexity, без независимой проверки со стороны.

Китайская модель с американским полигоном

GLM 5.2 - модель на 744 млрд параметров от Z.ai, бывшей Zhipu AI. Пекинская лаборатория с января 2025 года находится в санкционном списке Entity List Минторга США. Санкции не помешали Perplexity воспользоваться её разработкой: GLM 5.2 вышла в июне под лицензией MIT, а такая лицензия снимает вопрос доступа - веса можно скачать, изменить и дообучить без ограничений.

Для Perplexity это уже второй подобный проект за полтора года. В начале 2025 года компания выпустила R1-1776 - версию DeepSeek R1, из которой убрали около 300 тем, подпадавших под цензуру китайских властей. Тогда цель была политической: сделать рассуждающую модель пригодной для использования на Западе. Сейчас мотивация другая, экономическая - снизить стоимость обслуживания массового агентного продукта, не потеряв в качестве.

Дообученная GLM 5.2 работает на серверах Perplexity в США на видеокартах Nvidia B200.

Следующая цель - Nemotron 3 Ultra

Perplexity не планирует останавливаться на одной модели. Следующим шагом компания намерена применить тот же приём дообучения к Nemotron 3 Ultra - открытой модели американского происхождения. Так снимается вопрос, который неизбежно возникнет у части корпоративных клиентов: готовность строить инфраструктуру на китайских весах, пусть и открытых.

Пока это исследовательское превью, доступное пользователям Computer уже сейчас, а не обещание на будущее. Но судить об экономике рано: цифры о цене и качестве - внутренние метрики самой Perplexity. Ориентир - публикация полного бенчмарка и research paper в ближайшие недели. Тогда будет видно, держит ли связка GLM 5.2 и advisor заявленную треть цены Opus на практике, а не на графике в презентации.

08:45
213
Нет комментариев. Ваш будет первым!