Обычный путь Meta к исследовательской математике
2 октября 2026 года исследовательское подразделение Meta опубликовало шесть математических статей исследовательского уровня — плод сотрудничества внешних учёных с моделью Muse Spark версий 1.1 и 1.2. Meta подчёркивает разницу в методе: никакой специально построенной агентной системы, только обычный чат meta.ai в режиме 'Thinking Mode', без исследовательской инфраструктуры, сделанной на заказ. На протяжении нескольких месяцев исследователи-люди выбирали задачи и стратегии доказательства, затем проверяли выкладки модели и закрывали пробелы в её рассуждениях. По словам Meta, после этого вторая группа математиков независимо проверила работу.
Результаты охватывают шесть научных областей, в том числе оптимизацию и неассоциативную алгебру. В теории групп статья математиков Joseph Phillip Brennan и Milana Golich опровергает гипотезу, сформулированную в 2024 году M. Kida: авторы нашли конкретный контрпример — конечную полуабелеву группу порядка 384 — с помощью поискового кода для GAP, сгенерированного моделью, как задокументировало издание AlphaSignal. Однако приоритет не безусловен: сама публикация Meta отмечает, что как минимум в трёх случаях другие пришли к параллельным результатам в тот же период. Это три работы августа 2026 года о подгонке гауссовых эллипсоидов, другой контрпример для полуабелевых групп, найденный ИИ-агентом Nilradical 16 сентября, и контрпримеры Hu и Wen для эволюционных алгебр.
Осторожность нужна и в методологическом плане. Тексты распространяются в формате PDF на сайте Meta, а в посте-презентации не сказано, что они прошли рецензирование в научных журналах. Кроме того, работа о подгонке гауссовых эллипсоидов прямо признаёт в самом тексте статьи, что поведение на критическом пороге остаётся невыясненным. Meta не приводит данных ни о числе неудачных и брошенных попыток, ни о времени, которое исследователи действительно сэкономили; нет и точной оценки вклада модели в каждую работу, хотя в документах указано, какие фрагменты написал искусственный интеллект.
Эксперимент позволяет предположить, что даже публичный чат, без выстроенных вокруг него лесов, способен внести вклад в исследования: как часто это удаётся — остаётся за пределами данных, потому что безрезультатные попытки никто не считал. В шести описанных случаях строгость по-прежнему обеспечивал человеческий контроль. Модель выглядит не столько самостоятельным математиком, сколько инструментом, чтобы исследовать идеи, искать контрпримеры и писать код, который их ищет, — в случае полуабелевых групп этого хватило, чтобы опровергнуть гипотезу 2024 года, — а её реальная польза зависит от терпения тех, кто проверяет её пределы. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Я открыла через WebFetch официальный пост Meta AI Research (дата, число статей, фраза 'Five present answers…', использованный интерфейс, продолжительность, конкурирующие работы) и официальную страницу статьи о полуабелевых группах (авторы, порядок 384, идентификатор GAP, раздел об использовании ИИ). Для независимого подтверждения я использовала AlphaSignal: там те же цифры (6 статей, 5 открытых задач, чат meta.ai в Thinking Mode, контрпример из 384 элементов) и описаны ограничения. Пост Alexandr Wang в X тоже перечисляет те же шесть названий.
- Incertezze
- Статьи опубликованы самой Meta, признаков журнального рецензирования нет. Видны только удачные совместные работы: данных о задачах, за которые брались и бросили, и о сэкономленном времени нет. Как минимум три результата в тот же период независимо получили другие группы, так что приоритет не исключительный. Воспроизводимость зависит от закрытой модели конкретных версий. Meta не даёт точной оценки вклада модели в каждую статью.
- Perché pubblicarla
- Это задокументированный исследовательский результат с доступными статьями, открытый в отношении своих ограничений (конкурирующие работы, оставшиеся открытыми задачи). Он касается центрального вопроса момента: насколько универсальные модели действительно помогают научным открытиям и под каким человеческим надзором. С уже опубликованными темами не пересекается.