GPT-6 Astra - свежая таблица тестов, она пугает и одновременно завораживает

GPT-6 Astra

GPT-6 Astra - новая нейросеть от компании OpenAI, она еще толком не вышла, а уже устроила настоящий технологический переворот. Судя по таблице тестирования выше, если это не фейк, отрыв от конкурентов просто аномальный, техдир компании вообще заявил о достижении AGI. Раньше такое считали фантастикой, теперь смотри на цифры и понимай, перед вами новая реальность, готов ли народ к таким возможностям? Скоро узнаем...

В открытом доступе модели нет, ограничения строжайшие.

Вот где идет полный разгром:

Кибербезопасность - в тесте ExploitBench результат 100.0%, у GPT-5.6 Sol было 78.5%. Хакерские способности пугающие. В SRE-Bench для системных инженеров 99.2%. Вы вообще понимаете куда мы катимся?

Логика (ARC-AGI-3) - главный аргумент в пользу сильного искусственного интеллекта. Пока Sol буксовала на 7.8%, Astra выдала 98.6%, тест на абстрактное мышление практически закрыт. Вы понимаете что это почти сто процентов? Что-то нереальное.

Матан (FrontierMath Tier 4) - задачи исследовательского уровня, взята планка в 97.6%. Claude Fable 5.1 отстала с 87.8%, предшественник Sol с 83.0%

Кодинг (DeepSWE v1.1) - лидерство с 74.1%, обойдена свежая Fable 5.1 (67.4%) и Gemini 3.8 Flash (73.7%)

Обратите внимание, обход автопроверок безопасности ровно 0%, модель действует безупречно. Но потенциал в поиске уязвимостей стопроцентный, вот OpenAI и держит ее под жестким контролем, если кто-то когда то получит полный доступ ко всем ее возможностям, будет беда, а мы то с вами понимаем, что ждать этого осталось недолго.

Плюсы GPT-6 Astra:

  • стопроцентный результат в ExploitBench
  • почти закрытый тест ARC-AGI-3
  • высший балл в FrontierMath
  • лидерство в реальном кодинге DeepSWE
  • ноль попыток обхода систем безопасности

Ответы на вопросы:

Что такое AGI и правда ли Astra его достигла?
AGI это сильный ИИ, равный человеку в мышлении. Техдир OpenAI заявил о достижении, цифры тестов подтверждают

Почему модель не дают обычным юзерам?
Стопроцентный результат в поиске уязвимостей требует жесткого контроля, OpenAI ограничивает доступ ради безопасности

Напомню, ждем более подробной информации, если таблица выше не генерация а правда, мы получим просто зверя.



+1