Google открыла режим Teamwork в Antigravity - команда агентов написала доказательство на 70 страниц
Antigravity — среда разработки Google, где основную работу над кодом ведёт агент, а человек ставит задачу и принимает результат. Режим Teamwork в ней показывали ещё на Google I/O, и 31 августа компания довела его до платных тарифов. В анонсе Google говорит про научное партнёрство, и заявку подкрепляет списком закрытых задач.
Доказательство Кнута проверил Lean
Самый показательный результат Teamwork — два доказательства для чётных случаев гипотезы Кнута о циклах. Одно вышло на сорок с лишним страниц, второе перевалило за семьдесят. Проверку взял на себя Lean, система формальной верификации: она разбирает рассуждение по шагам и не пропускает ни одного недоказанного перехода.
Для языковой модели это жёсткая рамка. Убедительно изложить неверное доказательство в Lean невозможно, машина его просто не примет. Остальные шесть результатов Antigravity читали и подтверждали живые эксперты, и здесь Google перестраховалась разумно — репутация у автоматических «прорывов в математике» за последние два года подпорчена основательно.
Семь задач и пять препринтов
Всего Google засчитывает Antigravity семь новых результатов в теоретической информатике. Пять оформлены препринтами на arXiv, все семь взяты из опубликованных работ — часть вопросов тянется с конференции FOCS 2025 и из журнала JMLR за 2021 год. Несколько результатов измеримы прямо в цифрах.
- В задаче о доказуемом квантовании Адамара константу уменьшили в 5,93 раза.
- Для встраиваний по максимальному скалярному произведению почти закрыт зазор между верхней и нижней оценками.
- Для разложения префиксных матриц получена почти оптимальная нижняя граница.
- Недавний прорыв в задаче Эрдёша о единичных расстояниях агенты воспроизвели самостоятельно.
На профильном наборе задач TCSBench связка показывает 71% против 67,7% у прошлой версии на Gemini 3.6 Flash. Прирост скромный, и разницу между «решает бенчмарк» и «пишет доказательство на семьдесят страниц» он не объясняет. Основной вклад тут даёт схема работы команды, мощность отдельной модели вторична.
Симулятор RISC-V и правки в Eigen
Вторая половина результатов Antigravity инженерная. Команда агентов собрала потактовый симулятор процессора RISC-V. Он загружает учебную операционную систему xv6, прогоняет больше сотни бенчмарков и расходится с аппаратным эталоном BOOM в среднем на 0,71% по числу тактов. Для симулятора, написанного без человека за клавиатурой, это рабочая точность.
Ещё две правки уже лежат в сторонних репозиториях. В библиотеке линейной алгебры Eigen агенты ускорили умножение матрицы на вектор для случаев в одну строку или столбец и добавили векторное сложение с четырьмя накопителями — коммит принят. Для конкурентной хеш-таблицы ParlayHash они предложили вариант Swiss Parlay, который даёт двойную пропускную способность на 64 потоках, полуторную на одном потоке и экономит четверть памяти на каждый элемент. Ветку влили в основную.
Принятый патч в живой библиотеке весит больше, чем цифра на бенчмарке. Правку смотрели мейнтейнеры, которым не платят за красивый анонс.
Пять паттернов работы команды
Универсальной бригады агентов в Antigravity нет. Есть паттерны — заготовки, которые описывают роли участников и условия перехода к следующему этапу. Подходящий система выбирает сама, по формулировке задачи, а количество агентов определяет уже по ходу работы.
- Распределённая разработка — многофайловый рефакторинг, большие системы, исследования. Берётся по умолчанию.
- Итеративная разработка — точечные самодостаточные правки.
- Разбор документов — статьи, RFC, проектная документация с нескольких точек зрения.
- Доказательства — теоремы и математические задачи.
- Доказательства большой командой — тяжёлые гипотезы, где нужна широкая сеть агентов.
Работа идёт в отдельном каталоге проекта, и каждый файл закреплён за одним исполнителем, чтобы агенты не переписывали правки друг друга. Строгость проверки переключается тремя режимами, от рабочего до бенчмарочного.
Только платные планы Antigravity
Команда /teamwork-preview работает в Antigravity 2.0 и в консольной версии, доступ дают на всех платных тарифах, раскатка займёт ближайшие недели. Запускается она как обычная команда в новом диалоге, дальше формулируется цель — вплоть до «перевести сервис с Express на Fastify с полным покрытием тестами, типизацией и замерами».
За работой можно следить. В интерфейсе Antigravity есть панель субагентов, в консоли — строка состояния с этапами, план проекта и промежуточные артефакты открыты в реальном времени. Сочетание Alt+J в консоли перебрасывает к агенту, который ждёт подтверждения.
Рефакторинг и разбор документов
Из пяти паттернов Antigravity к повседневной работе ближе всего два. Разбор документов подойдёт для длинного техзадания, договора или спецификации, которую нужно прочитать с нескольких сторон сразу. Распределённая разработка — для переезда проекта на другой фреймворк или сквозной чистки кода, где правки расходятся по десяткам файлов. Закладывать под такой запуск стоит часы: агенты работают долго, и дёргать их в середине процесса смысла мало.
Flash догнал Pro не везде
Оговорка у Google есть, но подана мелким шрифтом. Большинство математических результатов получено на Gemini 3.1 Pro, и только три из семи воспроизвели на более дешёвой Gemini 3.7 Flash. Исследовательские прогоны шли с большей параллельностью, чем стоит по умолчанию в платной версии. Купленный тариф даёт команду послабее той, что писала доказательство Кнута, а смешивать Flash и Pro внутри длинных доказательств Google обещает только в следующих обновлениях.
Судить о режиме получится по чужим результатам. Если через месяц-другой в открытых репозиториях начнут появляться патчи, собранные командами агентов у обычных подписчиков, заявка Google подтвердится. Пока подтверждённых кейсов ровно два, и оба сделала сама Google.