OpenAI публикува 372 математически доказателства в GitHub с формална проверка в Lean 4

Снимка: The Decoder / OpenAI
Изследователският екип на OpenAI публикува в GitHub мащабен масив от 372 напълно нови математически доказателства, формализирани на езика Lean 4 за автоматична машинна проверка [1].
Всяко едно от доказателствата е генерирано автономно от модели за дълбоки разсъждения, като извеждането на всеки резултат е изисквало средно около три часа интензивни изчисления на ниво разсъждаваща верига (test-time compute) [1]. Публикацията обаче предизвика остра дискусия в академичната общност, след като 25 носители на престижния Филдсов медал изразиха загриженост, че масовото индустриално фабрикуване на математически истини заплашва да обезцени концептуалното разбиране в науката.

Инфографика: Светни.ме
Синтез на невронни евристики и формална верификация
Историческият успех на подхода се крие в комбинацията между интуицията на езиковия модел и безпощадната математическа строгост на софтуерната формална верификация. За разлика от стандартните научни статии, където рецензентите могат да пропуснат скрита грешка в сложни логически преходи, ядрото на Lean 4 не допуска никакви халюцинации: ако кодът се компилира успешно, доказателството е безусловно вярно [1].
Моделът използва търсене в дърво от състояния (tree search), коригирайки тактиките си в движение всеки път, когато компилаторът отхвърли междинна стъпка. Този цикъл на подсилващо самообучение превръща математическото изследване в алгоритмична игра с детерминистичен награден сигнал в областта на автоматизираното разсъждение.
Сблъсъкът между машинната мощ и човешкото прозрение
Реакцията на водещите световни математици подчертава дълбока философска пропаст. Докато инженерите на OpenAI разглеждат 372-те резултата като триумф на изчислителната мощ, академичните учени предупреждават, че едно машинно доказателство от хиляди редове формален синтаксис често не дава отговор на най-важния въпрос: защо теоремата е вярна.
Математиката традиционно се стреми към елегантни идеи и концептуални връзки, докато алгоритмичният брутфорс рискува да залее литературата с технически коректни, но стерилни резултати без човешко значение.
Дълбок технически анализ: Формалната математика като окончателният полигон за AGI
Отвъд академичните спорове за естетиката на доказателствата, ходът на OpenAI има фундаментално значение за бъдещето на изкуствения интелект. В продължение на години обучението на модели разчиташе на естествен човешки текст — ресурс, който бързо се изчерпва и страда от неточности и предразсъдъци.
Формалната математика в среди като Lean 4 е перфектният, неизчерпаем синтетичен източник на данни за обучение. Тя предоставя среда с перфектна верификация: машината знае със 100% сигурност кога разсъждението е правилно, без да се налага намеса на скъпоструващ човешки надзор. Способността на моделите да генерират нови валидни доказателства чрез часове паралелно разсъждение доказва, че скалирането при тестване (test-time compute scaling) отваря пътя към автономни научни открития, приложими не само в чистата алгебра, но и във верификацията на микрочипове и критичен аерокосмически софтуер.