Нейросеть решила десять задач, которые не поддавались математикам десятилетиями

1 августа OpenAI показала не новый чат-бот и не картинки. Компания выложила список из десяти математических задач, которые люди не могли решить по десять, двадцать и больше лет, — и заявила, что их закрыла ещё не вышедшая модель под именем Astra. К каждому результату приложен документ на 249 страниц и доказательство, которое проверяет не рецензент из журнала, а другая программа, строчка за строчкой. Вот это последнее — куда важнее самих задач.
Что именно произошло
Astra выдала решения для десяти открытых проблем из математики и теоретической информатики: теория групп, геометрия многомерных пространств, квантовая сложность, криптография на решётках. Одна из задач стояла с 1999 года — с тех пор её никто не мог сдвинуть. Модель дала первое в истории явное построение объекта, существование которого 25 лет оставалось под вопросом. Всё это опубликовано открыто: рукопись и файлы с доказательствами лежат на GitHub. Сама модель пока закрыта — наружу отдали результаты, а не доступ. Стоимость прогона, по оценке OpenAI, — около двух тысяч долларов.
Почему это не «очередная умная нейросеть»
Привычный чат-бот отвечает за секунды. Спросил — получил гладкий текст, часто правдоподобный, иногда выдуманный. Здесь другая история. Astra не выдаёт быстрый ответ, а работает над одной задачей долго — часами, а по замыслу OpenAI и днями, когда несколько таких моделей грызут проблему вместе, как команда. Это сдвиг в том, зачем вообще нужен ИИ. Не «быстро подскажи», а «сядь и доведи трудную вещь до конца». Секундная реакция и многочасовая осада сложной задачи — это разные инструменты, хоть внутри и одна технология.
Главное — не задачи, а проверка
Тут спрятана самая ценная деталь. Обычно, когда нейросеть выдаёт красивый ответ, вы не знаете, правда это или убедительная выдумка. Проверить может только специалист, и то долго. Astra отдала доказательства в формате, который читает специальная программа-проверщик: она проходит по каждому логическому шагу и говорит «да, сходится» или «нет, здесь дыра». Человеку не нужно быть математиком мирового уровня, чтобы поверить результату, — за него ручается машина. Это переворачивает главную слабость нейросетей. Раньше вопрос был «звучит уверенно, но можно ли доверять?». Теперь на узком классе задач ответ проверяется автоматически.
Что это меняет для бизнеса
Математика — только витрина. Тот же принцип работает везде, где результат можно проверить по формальным правилам. Код, который либо проходит тесты, либо нет. Расчёт, который либо сходится с балансом, либо нет. Договор, который либо соответствует внутреннему регламенту, либо нарушает пункт. В этих зонах связка «ИИ делает долгую работу + автоматическая проверка результата» перестаёт быть фантазией. Ценность не в том, что машина умнее человека, а в том, что её работу можно принять без слепого доверия. Для бизнеса это разница между «нейросеть что-то насчитала, перепроверяйте всё вручную» и «нейросеть сделала, проверка подтвердила, идём дальше».
Где подвох
Радоваться с оговорками. Во-первых, модель закрыта — это витрина возможностей, а не продукт на полке. Во-вторых, два тысячи долларов за один прогон и часы работы — это не «спросил и получил», такое окупается только на действительно дорогой задаче. В-третьих, весь фокус держится на том, что у задачи есть строгая проверка. В математике и коде она есть. А вот у рекламного текста, стратегии или переговоров формального проверщика не существует — там «правильно» решает человек и рынок. Переносить восторг с одной области на все подряд — прямой путь сжечь бюджет на том, что пока не работает.
Вывод
Astra — сигнал, что ИИ потихоньку меняет роль. От «быстрого ответа, которому нельзя до конца верить» к «долгой работе, результат которой можно проверить». Для бизнеса выигрывает не самая громкая модель, а связка из двух частей: машина, которая тянет трудную задачу, и способ автоматически убедиться, что она не соврала. Именно на второй части чаще всего спотыкаются, когда пытаются внедрить ИИ наспех. МАВИИ помогает бизнесу выстраивать ИИ там, где результат приносит пользу и его можно проверить, а не просто красиво выглядит в демо.
Хотите такого ИИ-агента себе?
Разберём ваши процессы и покажем, что можно автоматизировать за 5–7 дней.
Получить бесплатный разбор