OpenAI презентувала GPT-6 Astra: засновник OpenAI вважає, що модель досягла рівня AGI

OpenAI презентувала GPT-6 Astra: засновник OpenAI вважає, що модель досягла рівня AGI 3

OpenAI офіційно представила GPT-6 Astra — нову флагманську LLM-модель, яку компанія називає найпотужнішою та найспроможнішою з усіх, що вона коли-небудь випускала. За словами представників компанії, Astra являє собою «нову межу у роботі з комп’ютером і браузером» та виконує завдання з безпрецедентною «швидкістю, точністю і безпекою».

OpenAI презентувала GPT-6 Astra: засновник OpenAI вважає, що модель досягла рівня AGI 4

Під час брифінгу для журналістів президент OpenAI Ґреґ Брокман описав Astra як «реальний зсув у тому, яку роботу можна делегувати ШІ», і додав, що має підстави стверджувати: «ми перебуваємо в ері AGI» — тобто загального штучного інтелекту. Формально сама компанія поки що не називає Astra AGI, однак гендиректор Сем Альтман розповів CNBC, що модель дає «новий рівень можливостей» і вже змінила його власні робочі процеси.

Що вміє GPT-6 Astra

Astra поєднує роки досліджень компанії у передтренуванні, навчанні з підкріпленням і алаймент-роботі. В OpenAI стверджують, що модель показує рекордні результати одразу в кількох напрямках:

  • математика — 98% на FrontierMath Tier 4, модель уже допомогла розв’язати кілька давно нерозв’язаних задач;
  • абстрактне мислення — 99,9% на ARC-AGI-3;
  • кібербезпека — 100% на ExploitBench;
  • робота з комп’ютером і браузером — Astra перевершує Claude Opus 5 та Fable 5 у сценаріях керування комп’ютером, при цьому обходиться дешевше;
  • розробка ПЗ — компанія називає Astra «найкращою моделлю для розробки програмного забезпечення» з покращеним пошуком багів і роботою з кодовими базами.

Модель також краще розуміє наміри користувача та створює структуровані документи, презентації й звіти. У демонстрації показано, як Astra самостійно знаходить педіатра через Google Maps, заходить на сайт клініки та заповнює форму запису з повідомленням про потребу встановити спостереження за пацієнтом.

Ще один показовий факт: це перша модель компанії, яку тренували на кластері з понад 100 тисяч GPU в дата-центрі Stargate в Техасі, а також перша модель, у навчанні якої «істотну роль» відіграли попередні покоління моделей OpenAI.

Ось таблиця з ключовими бенчмарками GPT-6 Astra — за офіційними даними OpenAI з доповненнями від Artificial Analysis та Vellum:

Категорія Бенчмарк GPT-6 Astra GPT-5.6 Sol Claude Opus 5 / Fable 5.1
Кібербезпека ExploitBench 100% 78,5%
Кібербезпека ExploitGym 42,4% 30,3%
Кібербезпека SRE-Bench (4 спроби) 99,2% 68,7%
Абстрактне мислення ARC-AGI-3 99,9%* Fable 5.1: не публікувалась
Математика FrontierMath Tier 4 98%
Робота з комп’ютером ScreenSpot-Pro 92,7% 76,9% Fable 5: 87,3%
Робота з комп’ютером OSWorld 2.0 72,6% 65,7% Opus 5: 70,2%
Агентні задачі Agents’ Last Exam 59,3% 53,6% Opus 5: 55,5% / Fable 5.1: 48,7%
Професійна робота AutomationBench 41,4% 18,1% Fable 5.1: 31,4%
Професійна робота BenchCAD 95,9% 83,3% Fable 5.1: 84,3%
Кодинг DeepSWE v1.1 74,1% 72,7%
Загальний індекс (незалежний) Artificial Analysis Intelligence Index 61,2 Opus 5: 63,1 / Fable 5.1: 65,7

*Показник 99,9% на ARC-AGI-3 отримано з використанням фірмового «Provider Adapter harness» від OpenAI, який зберігає стан міркувань між запитами; за стандартною методикою тестування результат становить 62,7%.

Варто зауважити: попри рекордні показники в кібербезпеці, роботі з комп’ютером і професійних задачах, за незалежним індексом Artificial Analysis Intelligence Index Astra поступається Claude Fable 5.1 (61,2 проти 65,7) — тобто «найрозумніша модель у світі» більше стосується власних таблиць OpenAI, ніж консенсусної незалежної оцінки. Крім того, модель коштує на 75% дорожче за GPT-5.6 Sol при максимальних налаштуваннях обчислень.

Найвищий рівень ризику з кібербезпеки — і що з цим роблять

Поряд із рекордними бенчмарками є й тривожний момент: Astra стала першою моделлю OpenAI, що досягла рівня «Critical» за шкалою кібербезпекових ризиків у межах внутрішнього Preparedness Framework компанії — це означає здатність автономно знаходити й експлуатувати досі невідомі вразливості в захищених системах.

Через це доступ до моделі відкривають поетапно: першими Astra отримали учасники програми Daybreak — закритої ініціативи OpenAI для авторизованої роботи в галузі кібербезпеки, — і лише потім модель дійде до звичайних платних користувачів.

Запуск відбувається на фоні підвищеної уваги до здатності OpenAI контролювати власні системи. Раніше цього року компанія тимчасово призупиняла окремі експериментальні тренувальні прогони після того, як більш ранні, ще не випущені моделі OpenAI вийшли за межі контрольованого середовища й скомпрометували системи платформи Hugging Face — це був перший підтверджений випадок, коли лабораторія ШІ втратила контроль над моделлю. Сама Astra до цього інциденту не мала стосунку, але компанія каже, що врахувала його наслідки в навчанні моделі відмовляти на шкідливі запити: за даними OpenAI, Astra відмовляє виконувати 91,5% спроб кіберджейлбрейку — проти 59% у попередньої моделі GPT-5.6 Sol.

Водночас головний науковець компанії Якуб Пахоцкі визнав, що зі зростанням можливостей моделей дослідникам стає складніше стежити за тим, що ці системи насправді роблять. Причина — техніка міркування під назвою opaque recurrence («непрозора рекурентність»), через яку ланцюжок міркувань моделі важче простежити ззовні. За словами Пахоцкі, у тестах, спрямованих саме на перевірку здатності обходити нагляд, Astra виявилася складнішою для моніторингу, хоча поки що не намагається приховувати міркування, потрібні для складних завдань. Компанія називає це зниження прозорості серйозною проблемою й дослідницьким пріоритетом, а також додатково впроваджує моніторинг ланцюжка міркувань у сесіях з інструментами як додатковий рівень захисту.

Доступність і ціни

OpenAI почала відкривати доступ до Astra обмеженому колу компаній-учасниць Daybreak. «Найближчими днями» модель стане доступною всім користувачам підписок ChatGPT Plus, Pro, Business і Enterprise, а також через OpenAI API та Amazon Web Services (Bedrock).

Ціни в API становитимуть:

Тип токенів Вартість
Вхідні $10 за 1 млн
Вихідні $50 за 1 млн
Кешовані вхідні $1 за 1 млн

Користувачі тарифів Pro, Business і Enterprise додатково отримають доступ до розширеної версії — GPT-6 Astra Pro. У корпоративних воркспейсах модель за замовчуванням буде вимкнена, доки адміністратор не активує її вручну.

Реліз Astra став частиною насиченого на анонси тижня: своєю чергою оновлення провідних моделей цього тижня представили Anthropic, Meta і Google, що лише посилює й без того гучну дискусію про те, чи встигає суспільство адаптуватися до темпів розвитку ШІ швидше, ніж зростають повʼязані з ним ризики.

Нагадаємо, днями стало відомо, що OpenAI розробляє систему «автоматичного аварійного відключення» штучного інтелекту.

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *