Самостоятельное исследование на уровне PhD
11 августа 2026 года пользователь Mitchell_Porter провёл эксперимент с моделью GPT 5.6 Sol High. Целью было обсуждение одной из задач тысячелетия — гипотезы Бирча — Свиннертон-Дайера (BSD) в области теории чисел. Ожидая краткой беседы, автор столкнулся с совершенно иной картиной: ИИ не просто отвечал на вопросы, а инициировал процесс «исследования».
Ключевая особенность сессии — самоуправляемость. Модель самостоятельно предлагала следующие шаги, корректировала концептуальные подходы и усложняла конструкции абстрактных объектов. Роль человека свелась к подтверждению предложенных направлений. В результате была выведена новая обобщённая форма гипотезы BSD, что требует уровня креативности, сопоставимого с работой ведущих математиков мира.
Контекст: Anthropic и Риманова гипотеза
Этот инцидент стал частью более широкого тренда. В тот же день компания Anthropic объявила, что её сотрудник с помощью модели Claude радикально улучшил оценку, связанную с гипотезой Римана. Примечательно, что ключевым фактором успеха стала не новая архитектура, а промпт, побуждающий ИИ «верить в себя» и действовать амбициозно. Это демонстрирует, что frontier-модели уже способны к прорывным открытиям в самых сложных разделах математики.
Сравнение прорывов в математике
| Модель / Инструмент | Лаборатория | Результат | Значимость |
|---|---|---|---|
| GPT 5.6 Sol High | OpenAI (доступ по подписке) | Обобщение гипотезы BSD | Самостоятельное формирование исследовательской траектории |
| Claude (версия не указана) | Anthropic | Улучшение оценки для гипотезы Римана | Прямое улучшение известного математического предела |
Почему это важно для всех
Автор поста утверждает, что большинство недооценивает масштаб этих событий. Решение задач уровня Millennium Problems — это высший пилотаж человеческого интеллекта. Если ИИ автоматизирует этот процесс, то способность к «самому сложному мышлению» перестаёт быть уникальным преимуществом человека. Это рассматривается как один из последних сигналов перед тем, как ИИ станет умнее людей во всех сферах, а не только в узких технических задачах.
Источник: LessWrong ↗
