«Давай ещё раз. Верь в себя» — и ИИ сдвинул математику на 25% 🤯
Сотрудник Anthropic решил провести эксперимент: дал исследовательской версии Claude одну из самых знаменитых нерешённых задач — гипотезу Римана.
Ей уже 166 лет, за доказательство обещан $1 млн, а лучшие математики мира бьются над ней десятилетиями.
Саму гипотезу Claude не доказал. Но произошло кое-что не менее интересное.
Если совсем просто: математики пытаются доказать, какая доля нулей дзета-функции точно находится на критической прямой.
📌 1974 — 33,3%
📌 2020 — 41,6%
🔥 Claude — 67,2%
То есть за 46 лет люди прибавили около 8 процентных пунктов. Claude — ещё 25,6 пункта за две исследовательские сессии.
Но больше всего мне понравилось, как это произошло.
Сначала модель перебрала более 600 идей — и ничего не сработало.
Тогда человек написал ей примерно:
«Давай ещё раз. Верь в себя». 😂
И Claude пошёл на новый круг.
Около полутора суток работы, 60 субагентов, тысячи проверок и 31 млн выходных токенов. В итоге модель соединила идеи из свежих исследований с результатом из работы 2000 года — и нашла новый ход.
И вот здесь, мне кажется, самое важное.
ИИ не придумал математику из воздуха. Он сделал то, что человеку невероятно тяжело делать в таком масштабе: прочитал огромный объём информации, удержал сотни подходов и перебирал их комбинации, пока одна не сработала.
Человек после 600 неудач может решить, что всё — тупик.
ИИ просто начинает 601-ю попытку.
⚠️ Полноценного peer review пока не было. Но доказательство формализовано в Lean и дополнительно проверялось математиками.
И если результат устоит, важны даже не эти 67,2%.
Важно другое.
Мы постепенно переходим от:
«ИИ знает почти всё, что уже знает человечество»
к:
«ИИ помогает человечеству узнавать то, чего оно ещё не знало».
И вот это уже совсем другой уровень.
А мораль прекрасна:
Не получилось 600 раз?
Давай ещё раз. Верь в себя. 💪😁
#ИИ #Claude #Anthropic #математика #AI
Сотрудник Anthropic решил провести эксперимент: дал исследовательской версии Claude одну из самых знаменитых нерешённых задач — гипотезу Римана.
Ей уже 166 лет, за доказательство обещан $1 млн, а лучшие математики мира бьются над ней десятилетиями.
Саму гипотезу Claude не доказал. Но произошло кое-что не менее интересное.
Если совсем просто: математики пытаются доказать, какая доля нулей дзета-функции точно находится на критической прямой.
📌 1974 — 33,3%
📌 2020 — 41,6%
🔥 Claude — 67,2%
То есть за 46 лет люди прибавили около 8 процентных пунктов. Claude — ещё 25,6 пункта за две исследовательские сессии.
Но больше всего мне понравилось, как это произошло.
Сначала модель перебрала более 600 идей — и ничего не сработало.
Тогда человек написал ей примерно:
«Давай ещё раз. Верь в себя». 😂
И Claude пошёл на новый круг.
Около полутора суток работы, 60 субагентов, тысячи проверок и 31 млн выходных токенов. В итоге модель соединила идеи из свежих исследований с результатом из работы 2000 года — и нашла новый ход.
И вот здесь, мне кажется, самое важное.
ИИ не придумал математику из воздуха. Он сделал то, что человеку невероятно тяжело делать в таком масштабе: прочитал огромный объём информации, удержал сотни подходов и перебирал их комбинации, пока одна не сработала.
Человек после 600 неудач может решить, что всё — тупик.
ИИ просто начинает 601-ю попытку.
⚠️ Полноценного peer review пока не было. Но доказательство формализовано в Lean и дополнительно проверялось математиками.
И если результат устоит, важны даже не эти 67,2%.
Важно другое.
Мы постепенно переходим от:
«ИИ знает почти всё, что уже знает человечество»
к:
«ИИ помогает человечеству узнавать то, чего оно ещё не знало».
И вот это уже совсем другой уровень.
А мораль прекрасна:
Не получилось 600 раз?
Давай ещё раз. Верь в себя. 💪😁
#ИИ #Claude #Anthropic #математика #AI