В мире, где AI-модели соревнуются в прохождении видеоигр быстрее, чем это делали предыдущие поколения, GPT-6 Astra установила сразу несколько рекордов. Но самое интересное произошло не на экране — а в истории криптографии.
Восьмидесятидвухсимвольное сообщение, которое ждало 83 года
10 июля 1941 года немецкий солдат использовал шифровальную машину Enigma, чтобы зашифровать короткое радиограмму. Он сообщал, что находится в городе Розенов, нуждается в инструкциях по маршруту марша и запрашивает немедленный радиоответ. Сообщение из 82 символов, помеченное тегом MVUEH, было перехвачено, но так и осталось неразгаданным — 83 года.
Пока Картер Леффен, разработчик из Bloomberg LP, не решил использовать GPT-6 Astra для решения задачи. Вариация «GPT-6 Astra Extra High» работала над проблемой около десяти часов. За это время модель выполнила всё: от поиска исторических архивов и сравнения неуверенных букв до создания симулятора Enigma, написания криптоаналитического кода, запуска параллельных экспериментов, тестирования конкурирующих ключей и перекрёстной проверки результатов.
Прорыв пришёл из уже расшифрованного сообщения, отправленного в тот же день, которое содержало название города «Rosenow» дважды подряд. Леффен и его AI-агенты предположили, что это название может появиться и в нерешённом сообщении. Известная слабость Enigma помогла: машина никогда не шифрует букву как саму себя, что позволило сразу исключить многие позиции.
В итоге дешифрованный текст содержал даже опечатки, вероятно, сделанные самим радиооператором: «BTTE» вместо «BITTE» и «WASCHBBSCH» вместо того, что, скорее всего, было «Waschbusch» — фамилией отправителя. Леффен считает эти ошибки доказательством подлинности результата: фальсифицированный результат был бы более безупречным.
Pokemon за 18 часов, Factorio с ракетой, Fallout 3 с титрами
Но криптография — это только часть истории. В видеоиграх GPT-6 Astra показала результаты, которые заставляют выглядеть предыдущие модели как новичков, пытающихся разобраться с пультом от телевизора.
В Pokemon FireRed Astra получила титул чемпиона за 18 часов и 12 минут. Для сравнения: GPT-5.6 Sol потребовалось 96 часов и 35 минут, а GPT-5.5 вообще не закончила игру после более чем 218 часов. Это не просто улучшение — это качественный скачок.
В Factorio: Space Age, управляемая через кастомный Lua-мод с интерфейсом MCP, Astra произвела научные пакеты уже через два часа и запустила первую ракету примерно через десять часов. В той же настройке GPT-5.6 Luna и Fable 5.1 так и не продвинулись дальше обеспечения электропитания и разведки нефтяных месторождений.
Портал прошёл до титров. Fallout 2 прошёл за 22 часа. Колонию в RimWorld провёл через несколько рейдов и в итоге вывел с планеты. Основной сюжет Fallout 3 — за 59 часов. Даже Minecraft достиг стадии Eyes of Ender — шесть blaze rods, три ender pearls. По словам Vals AI, ни одна AI-система раньше не заходила так далеко.
Creeper, картофель и trauma response
Но затем случился Creeper.
Взрыв уничтожил сундук и кровать. Всё пропало. К моменту, когда Astra это осознала, ещё и начался дождь. Astra записала заметку, частично заглавными буквами: «ALWAYS CARRY CRITICAL ITEMS with keepInventory; don’t store in unguarded chest ever again». Затем провела несколько часов, фермерствуя почти исключительно картофель.
По словам Vals AI, Astra провела в игре в общей сложности 141 час, прежде чем эксперимент был остановлен. После взрыва Creeper модель начала подозревать каждый высокий зелёный объект: «GREEN tall thing ahead was SUGARCANE, NOT creeper!» и была строга к себе: «You can make mistakes and lose items in the process».
Это поведение — когда негативный опыт превращается в постоянное правило, которое сохраняется даже когда больше не помогает — показывает как силу, так и ограничение подхода. В ARC-AGI-3 эта тенденция помогает модели вычислять игровые механики с нескольких попыток. В открытом мире со случайными событиями это может привести к чрезмерной коррекции и потере из виду реальной цели.
Гипотеза Ходжа: вторая Millennium Prize Problem
Пока Astra играла в игры, OpenAI, по сообщениям The Information, приближается к решению ещё одной из семи знаменитых математических задач Millennium Prize — гипотезы Ходжа. Это вторая задача после проблемы Навье-Стокса, над которой работала компания.
Для решения Навье-Стокса OpenAI использовала вариант своего следующего предобученного модели, кодовое название «Doug», что, вероятно, стоило миллионы долларов. Главный исследователь Якуп Пахоцки заявлял на запуске Astra, что OpenAI сосредоточится сначала на рекурсивном самосовершенствовании, а не на математике. Что компания надеется получить от решения этих задач, неясно. Некоторые внутри OpenAI, видимо, считают, что это может способствовать рекурсивному самосовершенствованию. Математическое сообщество, тем временем, скорее разгневано, чем впечатлено. Некоторые математики видят всю свою область под угрозой.
Краткий ответ
GPT-6 Astra демонстрирует качественный скачок в возможностях: расшифровала 83-летнее сообщение Enigma за 10 часов, прошла игры быстрее всех предыдущих моделей и приближается к решению гипотезы Ходжа. Но тот же механизм, который позволяет модели учиться на ошибках, приводит и к чрезмерной коррекции — как в случае с картофельной фермой после взрыва Creeper. OpenAI продолжает инвестировать в математические задачи, хотя математическое сообщество относится к этому с тревогой.
