То ли прорыв тысячелетия, то ли нейропсихоз.
Бывший сотрудник DeepMind (ученый, опытный инженер) объявил, что с помощью чат-бота решил задачу, над которой математики бьются 25 лет. Против него поставили 10 тыс. долларов. Ему пока мало кто верит. Но интересно тут совсем другое. А не случай ли это "LLM-психоза", когда даже очень умный человек (спец по ИИ) принимает вежливое согласие нейросети за реальную экспертизу?
В 2000 году Институт Клэя выбрал семь математических задач, за решение каждой из которых пообещал миллион долларов. С тех пор решили только одну. Остальные шесть, включая проблему Навье-Стокса, остаются открытыми уже 25 лет. И вот бывший сотрудник DeepMind Дэвид Бадден объявил в соцсетях, что он ее решил.
Уравнения Навье-Стокса описывают движение жидкостей и газов: от воды в трубе до воздуха вокруг крыла самолета. Инженеры пользуются ими каждый день. Проблема в том, что математики до сих пор не могут доказать: всегда ли эти уравнения дают "хорошие" решения, или при каких-то условиях они ломаются и выдают бесконечности? Это и есть задача тысячелетия.
Бадден пообещал не просто доказательство, а доказательство в системе Lean. Это такой язык программирования, где компьютер автоматически проверяет каждый логический шаг. Никаких "поверьте мне на слово", либо код компилируется, либо нет.
Маркус Хаттер, известный исследователь ИИ, тут же поставил против него 10 тыс. долларов. С Бадденом они заключили пари, на скриншоте даже с подписями. А в сервисе, где можно ставить за или против чего угодно, хоть пришествия инопланетян или второго пришествия Христа, оценили шансы Баддена в 3-5% (пока писал пост, с 96% против доползло до 98% против).
А потом Бадден выложил файл.
И сообщество быстро обнаружило проблему. Его "доказательство" принимает ключевые утверждения о поведении решений как готовые аксиомы. Вместо того чтобы их выводить. Грубо говоря, это как "доказать", что вы миллионер, начав рассуждение со слов "допустим, у меня есть миллион". Формально все верно. Но это не совсем то, чего ждут от решения задачи тысячелетия.
Но вот что делает историю по-настоящему любопытной. В качестве подтверждения Бадден выложил скриншот, где Claude одобряет его подход. Мол, смотрите, ИИ согласен. И это моментально вызвало волну комментариев про "LLM-психоз" — так в ИИ-сообществе называют ситуацию, когда человек начинает принимать вежливое согласие языковой модели за реальную экспертизу.
Важно понимать (и напоминать соседям), что языковые модели действительно склонны соглашаться с пользователем. Они могут убедительно кивать на полную ерунду. Использовать их как арбитра истины, это примерно как спрашивать у вежливого официанта, правда ли вы хорошо выглядите.
Файл, что выложил Бадден, это пока не доказательство полноценное, а такая затравка или прототип, вроде как подразнить публику. Срок пари истекает автоматически 31 декабря. По условиям, Бадден должен загрузить полноценную статью с решением проблемы Навье-Стокса на
arXiv.org. Все эти обрывки и скриншоты в твиттере не считаются.
Если Бадден сдюжит, это будет определенно победа года. Ну и для математики неплохой результат, если не забывать, ради чего сыр-бор.
Файл как бы доказательства, по сути наброска:
https://x.com/davidmbudden/status/2002627726877069805
Про аксиомы в Lean:
https://x.com/ElliotGlazer/status/2002522818152706280?s=20
Приметы ИИ-психоза:
https://x.com/davidmbudden/status/2002549962958401849
===
✈️
Эксклюзивные ролики в ТГ
🚀
Другие способы поддержать нас
@sci_one_tv