OpenAI представила GPT-6 Astra — нову флагманську модель для складних багатокрокових завдань. Компанія називає її найпотужнішою у своїй лінійці, а президент OpenAI Грег Брокман заявив, що особисто вважає межу штучного загального інтелекту пройденою. Водночас це залишається оцінкою керівника компанії, а не загальновизнаним науковим фактом.
За офіційною сторінкою моделі, Astra призначена для програмування, досліджень, роботи з браузером і професійними програмами. Вона може виконувати довші послідовності дій без постійного ручного втручання: форматувати документи, працювати всередині інструментів, створювати програмні проєкти та перевіряти результат.
Доступ розгортатимуть поступово
Першими GPT-6 Astra отримують організації з програми Trusted Access. Доступ через API та плани ChatGPT Plus, Pro, Business і Enterprise OpenAI обіцяє розширювати протягом найближчих днів. Для API заявлено контекстне вікно на 1,05 млн токенів і максимальну відповідь до 128 тисяч токенів.
Модель підтримує вебпошук, роботу з файлами, виконання коду, комп’ютерне керування, MCP та інші інструменти. Це підкреслює головний напрям розвитку: ШІ переходить від генерації окремої відповіді до виконання завершених робочих процесів.
Кіберможливості Astra отримали критичний рівень
Найбільш чутлива частина релізу стосується кібербезпеки. У системній картці GPT-6 Astra OpenAI називає її першою своєю моделлю, яка досягла рівня Critical за внутрішньою шкалою кіберможливостей. У тестах модель могла знаходити раніше невідомі вразливості та розробляти способи їх експлуатації.
Через це найпотужніші кіберфункції не відкривають усім користувачам одразу. Компанія обмежує їх для перевірених учасників і посилює моніторинг автономних дій. За оприлюдненими результатами, Astra отримала 100% на ExploitBench і 99,2% на SRE-Bench за чотири спроби. Водночас один тест не означає безпомилковості в реальному середовищі.
Чи означає це появу AGI
AGI зазвичай описують як систему, здатну на людському рівні або вище розв’язувати широкий спектр інтелектуальних задач, а не лише одну вузьку проблему. Єдиного тесту чи загальноприйнятої межі AGI не існує. Тому заява Брокмана радше задає рамку для дискусії про автономність і практичну універсальність Astra.
Справжню межу можливостей покажуть незалежні перевірки та повсякденне використання. Особливо важливими будуть надійність довгих процесів, частота критичних помилок і здатність системи дотримуватися обмежень, коли вона працює з реальними файлами, програмами та інфраструктурою.
Новий реліз продовжує тенденцію, яку ми вже розглядали в матеріалі про автономну роботу GPT-5.6 Sol над математичною задачею. Ширший контекст розвитку агентів, локальних моделей і ролі людської перевірки зібрано у підсумковій статті «Що зміг і чого не зміг ШІ на сьогодні?».