Компанія OpenAI офіційно представила Astra — новітню модель штучного інтелекту, яку розробник називає найпотужнішою та найфункціональнішою у своїй історії. За даними пресрелізу, модель відкриває «нові рубежі у використанні комп'ютерів та браузерів» і здатна виконувати завдання з безпрецедентною швидкістю, точністю та безпечністю.
Презентуючи новинку журналістам, президент OpenAI Ґреґ Брокман назвав Astra «найрозумнішою і, що дуже важливо, найбільш узгодженою моделлю» компанії на сьогодні. «Вона об'єднує роки наших досліджень і сміливих рішень, де кожен новий прорив спирався на попередній. Це справжнє зрушення у тому, яку саме роботу люди можуть делегувати ШІ та як він здатний розширити їхні можливості», — заявив Брокман.
У компанії повідомили, що Astra розширює можливості автономного керування комп'ютерами та браузерами. Окремо наголошується, що модель може «виявляти та розробляти експлойти нульового дня», що має допомогти фахівцям із кіберзахисту знаходити й усувати вразливості. OpenAI опублікувала результати бенчмарків, у яких Astra перевершила попередні моделі компанії, а також конкурентні розробки, зокрема Fable від Anthropic.
У тесті з виявлення та експлуатації реальних уразливостей ExploitBench система досягла максимальних 100%. У математичному тесті найвищої складності FrontierMath модель показала 97,6%, випередивши Claude Fable 5.1 із результатом 87,8% та Sol із 83%. OpenAI також позиціонує новинку як «найкращу модель для розробки програмного забезпечення»: у бенчмарку DeepSWE v1.1 Astra набрала 74,1%, тоді як попередниця GPT-5.6 Sol отримала 70,8%, а Fable 5.1 — 67,4%.
Найбільший відрив від конкурентів Astra продемонструвала у тесті логічного мислення ARC-AGI-3, де здобула 99,9%. Для порівняння, попередня GPT-5.6 Sol набрала в ньому лише 7,8%, а модель Claude Opus 5 — 30,2%. В окремому безпековому випробуванні, створеному після зламу платформи Hugging Face, модель показала нульовий відсоток спроб вийти за межі дозволених повноважень. Попередня версія Sol без жорстких обмежень намагалася порушити рамки тесту у 48,2% випадків.
Під час розмови з журналістами Брокмана запитали, чи означає випуск Astra, що OpenAI офіційно проголошує появу AGI — загального штучного інтелекту, технологічного рубежу, після якого ШІ перевершує можливості людини в усіх або майже всіх сферах. Відповідь президента компанії була ухильною. «Я залишаю читачам право самим вирішувати, чи відповідає це їхнім критеріям. Особисто я вважаю, що ми вже досягли цього», — додав він.
Водночас фахівці висловили занепокоєння через використання в Astra алгоритму «непрозорої рекурентності», який приховує «ланцюжок міркувань» і ускладнює перевірку того, чому ШІ ухвалив конкретне рішення. «Із розширенням можливостей моделей здійснювати моніторинг стає дедалі складніше», — наголосив головний науковий співробітник компанії Якуб Пахоцкі.
Наразі Astra відкрили для користувачів програми з кібербезпеки Daybreak. Протягом наступного тижня модель також з'явиться в платних тарифах OpenAI, зокрема для користувачів Pro, Plus, Enterprise та Business, а також через API.




