#формальная верификация

И исследования ·20 авг 2026

Теренс Тао: ИИ может вызвать кризис математики масштаба теорем Гёделя

Математик Теренс Тао предупреждает: ИИ уже решает исследовательские задачи за десятки долларов, но угрожает разрушить систему ценностей математики — что считается вкладом, кто автор доказательства, как учить студентов. Это не про способности моделей, а про то, ради чего вообще существует математика как наука.

0 125
И исследования ·17 авг 2026

ИИ впервые проверил самое сложное математическое доказательство: теорема о простых числах и будущее безопасного кода

Команда Axiom Math автоматически верифицировала доказательство «теоремы 246» — важнейшего результата о простых числах. Это первый случай полной AI-проверки столь сложного доказательства. Главное: технология готовится проверять AI-код, на котором скоро будет работать весь мир.

0 118
И исследования ·17 авг 2026

ИИ Axiom Math формализовал в Lean доказательство теоремы о простых числах с разрывом до 246

Система AxiomProver от Axiom Math создала машинно-проверенное доказательство в языке формальной математики Lean 4 для теоремы о том, что бесконечно много пар простых чисел отличаются не более чем на 246 единиц — это сильнейший известный результат о промежутках между простыми числами. Работа опубликована 17 августа 2026 года как интерактивный blueprint с участием 41 соавтора.

0 47
И исследования ·12 авг 2026

Задача о 26 ферзях решена через формальное доказательство в Lean — классический комбинаторный вопрос закрыт

Математик доказал, что минимум 14 ферзей нужно для доминирования доски 26×26. SAT-солверы не справились, поэтому автор создал формальное доказательство в Lean 4 с помощью ChatGPT/Codex для поиска нестандартных алгоритмов. Проверено независимым ядром nanoda.

0 93
И исследования ·11 авг 2026

Нереализованная модель Anthropic продвинулась в решении гипотезы Римана — одной из главных задач математики

Экспериментальная модель Anthropic за полтора дня автономной работы значительно продвинулась в доказательстве гипотезы Римана — нерешённой математической проблемы с призом $1 млн. Модель протестировала 650 подходов, управляя 60 под-агентами и потратив 31 млн токенов. Результат подтвердили математики компании и формализовали через proof-ассистент Lean.

0 76
И инструменты ·8 авг 2026

Автоматический синтез и формальная верификация SWAR-трюка для INT4 через Z3 и Lean 4

Разработчик автоматизировал создание битовых оптимизаций для INT4 матричных вычислений: вместо ручного написания кода использовал SMT-решатель Z3 для синтеза алгоритма и доказал его корректность математически через Lean 4. Результат — гарантированно безошибочный брейнчлесс код для платформ без SIMD (WebAssembly, старые ARM).

0 82
Б безопасность ·8 авг 2026

Лауреат медали Филдса, писавший о вымирании человечества из-за AI, теперь работает в OpenAI

Джейкоб Цимерман, математик и свежий лауреат медали Филдса (математический «Нобель»), присоединился к команде AI Safety в OpenAI. Год назад он публиковал работу о сценариях полного вымирания человечества через AI («omnicide events»), теперь идёт решать проблему изнутри. Считает, что паника не нужна, но риски недооценены, а математики могут внести вклад — AI пока работает на эмпирике без строгих гарантий.

0 77
И инструменты ·3 авг 2026

AWS запустил автоматическое исправление политик Automated Reasoning в Bedrock — формальная логика без ручного редактирования

Amazon Bedrock теперь сам исправляет ошибки в политиках Automated Reasoning: диагностирует провалившиеся тесты, предлагает правки в формальной логике, вы только одобряете. Два режима: Iterative Refinement чинит логику правил, Ambiguous Variable Refinement — неоднозначность перевода из естественного языка. Раньше на правку уходили десятки итераций ручного редактирования SMT-LIB, теперь — одна кнопка.

0 107
И исследования ·1 авг 2026

OpenAI Astra решает открытые математические проблемы: AI переходит от объяснения к созданию нового знания

OpenAI опубликовала 249-страничный сборник с 10 математическими и теоретическими достижениями, полученными внутренней версией модели Astra. Модель самостоятельно решила открытые проблемы в геометрии, теории групп, квантовой сложности и криптографии, над которыми не было прогресса 10+ лет. Все результаты формализованы в Lean — можно проверить машинно, без доверия на слово. Это не просто решение сложных задач, а активное расширение научной границы.

0 122
И исследования ·28 июл 2026

Первая формально верифицированная 3D CSG: как доверять AI-коду без проверки 1000 строк

Разработчик создал первую формально верифицированную реализацию 3D CSG (пересечение мешей) на Lean 4. Вместо проверки 1000+ строк AI-кода достаточно прочитать 93 строки спецификации — корректность гарантирует компилятор Lean. AI автономно написал 60,000+ строк доказательств, которые не нужно читать человеку. Проект работает в браузере через WebAssembly.

0 104
И исследования ·28 июл 2026

Математика доверия к AI: можно ли формализовать истинность, обоснованность и надёжность утверждений модели

Исследователь хочет создать верификационный движок для проверки надёжности утверждений AI — не улучшать LLM, а математически доказывать, можно ли доверять её выводам. Вопрос: как формализовать «истину», «обоснованность» и «доверие» через теорию вероятностей, формальную логику, теорию информации или constraint satisfaction? Ищет математические основы для Trust Engine, а не философские рассуждения.

0 81