Google DeepMind випустила AI співматематика — багатoагентного помічника з математичних досліджень, який досяг 47,9% точності на бенчмарку FrontierMath Tier 4, перевершивши попередній рекорд GPT-5.5 Pro: 39,6% (станом на 9 травня). Система розв’язала 23 із 48 задач, зокрема 3, які не змогли розв’язати всі попередні моделі. Побудована на Gemini 3.1 Pro, архітектура використовує ієрархічну конструкцію: агент-координатор проєкту розподіляє завдання між підагентами, що займаються пошуком літератури, кодуванням і міркуванням, а кілька агентів-рецензентів перевіряють докази перед поданням.
Epoch AI провела сліпе тестування, не даючи команді DeepMind бачити задачі, при цьому на кожне питання відводилося 48 годин обчислень. У реальному застосуванні математик Марк Лакенбі використав систему, щоб розв’язати відкриту гіпотезу з Kourovka Notebook, продемонструвавши її практичну цінність для досліджень. Наразі система доступна обмеженій кількості математиків у бета-тестуванні.