#математика

Публикаций: 12

GPT-5.6 опроверг 30-летнюю гипотезу за 90 минут — математики пасовали годами

Профессор статистики Пенсильванского университета использовал GPT-5.6 Sol Pro для опровержения открытой математической конъектуры о методе Бенджамини-Хохберга — задачи, нерешённой около 30 лет. Модель справилась примерно за 90 минут; предшественник GPT-5.5 за 20 часов не нашёл ничего.

Человек — директор, ИИ — исполнитель: теорему доказали за неделю

Математик Джозеф Миллер формализовал сложный результат из математической физики в Lean 4 примерно за месяц — и сам не написал ни одного доказательства. Всё исполнял ИИ-агент под его руководством.

Человек ставит задачу, ИИ доказывает теоремы: Lean 4 за месяц

Математик Джозеф Миллер формализовал сложное доказательство из математической физики в Lean 4 — не написав ни строчки доказательства самостоятельно. Его роль: директор. Роль ИИ-агента: исполнитель.

GPT-5.6 Sol Ultra закрыл математическую гипотезу за час вместо 50 лет

GPT-5.6 Sol Ultra — новая модель OpenAI — за час построил доказательство Гипотезы о двойном цикловом покрытии, которая оставалась открытой 50 лет. Параллельно работали 64 субагента — и главный вопрос уже не в математике, а в том, что это значит для будущего AI-рассуждений.

GPT-5.6 Sol Ultra предъявил доказательство 50-летней задачи графовой теории

OpenAI опубликовала PDF с доказательством гипотезы о двойном покрытии циклами, составленным GPT-5.6 Sol Ultra. Задача открыта с 1979 года — если математическое сообщество подтвердит результат, это первая фундаментальная теорема комбинаторики, доказанная языковой моделью.

Wolfram Language 15: встроенный ИИ-ассистент и нативная интеграция с Claude Code

Почти через 38 лет после выхода Mathematica 1.0 Wolfram выпустил Version 15 — с встроенным AI Assistant в каждом notebook и прямой интеграцией с Claude Code и Codex прямо из коробки.

Claude Fable 5 обогнал GPT-5.5 на 13 пунктов по сложнейшей математике

Anthropic выпустила Claude Fable 5, который набрал 88% на самом сложном уровне бенчмарка FrontierMath — против 75% у GPT-5.5 от OpenAI. Для сравнения: Opus 4.5 в начале 2026 года едва дотягивал до 10% на том же тесте.

Как ИИ классифицирует нерешённые задачи среди 14 000 математических проблем

Туториал на MarkTechPost показывает, как за несколько шагов построить семантический поиск и классификатор статуса «открыта / решена» для математических задач — на датасете из 14 000 исследовательских проблем. Это не абстрактная демонстрация: тот же пайплайн работает на любом корпусе научных текстов, патентных баз или продуктовых баг-трекеров.

Терренс Тао: ИИ впервые сделает математику командным спортом

Один из лучших математиков мира утверждает: ИИ способен сломать главное ограничение математики — необходимость одному человеку удерживать всю цепочку доказательства в голове. Впереди — «промышленная математика» с командами и разделением труда.

Claude Mythos за выходные закрыл задачу Эрдёша — «изящное и простое» доказательство

Задача об единичных расстояниях простояла открытой почти 80 лет — OpenAI опроверг её, а Anthropic буквально следом показал: их предположительно ещё не выпущенная модель Mythos нашла собственное решение за выходные.

OpenAI опровергла гипотезу Эрдёша 1946 года — математики разбирают доказательство

Reasoning-модель OpenAI опровергла гипотезу Пола Эрдёша о геометрии единичных расстояний, открытую с 1946 года. Лауреат Медали Филдса Тим Гауэрс назвал результат «вехой в математике ИИ» и предупредил: людям скоро станет очень трудно конкурировать с ИИ в математике.

GPT-5.5 Pro за два часа сделала то, на что студенту нужны месяцы

Тимоти Гауэрс — обладатель Филдсовской премии и кембриджский профессор — передал GPT-5.5 Pro открытую задачу по аддитивной теории чисел. За неполных два часа модель улучшила верхнюю границу с экспоненциальной до полиномиальной — и автор исходного препринта назвал ключевую идею «полностью оригинальной».

← Все статьи