3 вересня 2026 року OpenAI розпочала розгортання GPT-6 Astra — нової флагманської моделі для складних багатокрокових задач. У своєму анонсі компанія називає її «найрозумнішою та найбільш узгодженою» моделлю у світі. Astra вміє не лише відповідати на запити: вона працює з браузером, кодом, документами та професійними програмами.
Утім, формулювання «найрозумніша у світі» варто сприймати як заяву виробника, а не як остаточний науковий вердикт. В окремих тестах GPT-6 Astra справді випереджає попередню модель OpenAI та конкурентів. Але незалежний Artificial Analysis ставить її приблизно на один рівень із GPT-5.6 Sol і нижче за Claude Fable 5.1 у своєму зведеному індексі.
Що таке GPT-6 Astra
GPT-6 Astra — це модель OpenAI для роботи «від початку до кінця»: від розуміння завдання до виконання послідовності дій у потрібних інструментах. Вона підтримує складне міркування, програмування, вебпошук, роботу з комп’ютером, аналіз даних і створення документів.
Згідно з документацією OpenAI API, модель має контекстне вікно на 1,05 млн токенів і може генерувати до 128 тис. токенів за відповідь. На вхід приймає текст та зображення, а на виході створює текст. Аудіо й відео в цій версії не підтримуються.
Суть Astra ще й у способі взаємодії. Користувач може доручити їй не окрему дію, а цілий ланцюжок: знайти дані, опрацювати їх у програмі, перевірити результат і підготувати фінальний файл. За повідомленням Axios, президент OpenAI Грег Брокман припустив, що саме ця модель може стати одним із кандидатів на роль переломного моменту в розвитку AGI — загального штучного інтелекту. Це оцінка керівника компанії, а не доведений статус технології.
У чому OpenAI бачить головний прорив
Комп’ютерні дії та робочі процеси
OpenAI задумала GPT-6 Astra як агента, що працює безпосередньо в цифровому середовищі. Серед прикладів компанія називає заповнення форм, оновлення записів у CRM, планування зустрічей, пошук інформації в інтернеті, підготовку листів і редагування документів.
Модель також може взаємодіяти зі спеціалізованим програмним забезпеченням. У демонстраціях OpenAI показує роботу з електронними таблицями, середовищами для 3D-моделювання, інструментами розробки ігор і системами для перевірки сайтів.
На OSWorld 2.0 Astra набрала 72,6% проти 65,7% у GPT-5.6 Sol. У симуляції затримок виконання завдання займало близько 40 хвилин замість 75. Важлива деталь: це не середній час роботи звичайного користувача, а результат конкретного тестового сценарію.
Оновлений Codex разом із Astra також показав 1,9 раза вищу швидкість виконання задач на Mind2Web, за даними OpenAI. Для довгих сесій компанія додала експериментальні нотатки між вікнами контексту: модель може повертатися до попередніх вимог і результатів тестів, навіть якщо вони не потрапили до короткого підсумку.
Код, наука та професійна робота
У програмуванні Astra має бути не просто «балакучим помічником», а самостійнішим виконавцем. Вона може встановлювати залежності, запускати тести, аналізувати помилки, вносити зміни в код і перевіряти, чи справді працює результат.
OpenAI заявляє про такі результати у власній таблиці оцінювань:
| Тест | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | 57,9% | 37,3% | 55,8% |
| FrontierMath Tier 4 | 97,6% | 83,0% | 87,8% |
| GPQA Diamond | 96,0% | 94,6% | 93,7% |
| HealthBench Professional | 63,4% | 60,5% | 58,1% |
У наукових задачах модель може працювати не лише з текстом, а й зі спеціалізованими програмами та даними. OpenAI також повідомляє про результати, пов’язані з дослідженням проміжків між простими числами. Однак такі твердження слід оцінювати разом із опублікованими доказами та незалежною перевіркою, а не лише за презентацією компанії.
Чи справді це найрозумніша модель у світі
Універсальної відповіді тут немає. Бенчмарки перевіряють різні властивості, а результат залежить від рівня міркування, доступних інструментів, системного промпту та оболонки агента. Сама OpenAI зазначає, що її оцінювання проводилися в дослідницькому середовищі або через API, тому поведінка у ChatGPT може відрізнятися.
У власній таблиці OpenAI Astra не виграє кожен тест. Наприклад, у Humanity’s Last Exam із використанням інструментів вона набрала 57,2% проти 65,0% у Claude Fable 5.1 і 63,6% у Claude Opus 5. Це не скасовує сильних результатів Astra в роботі з комп’ютером, кодом і математикою, але робить слово «найрозумніша» занадто широким.
Незалежна оцінка Artificial Analysis дає Astra близько 61 бала в Intelligence Index — приблизно стільки ж, як GPT-5.6 Sol. Claude Fable 5.1 у цьому індексі має 65,7 бала, а Claude Opus 5 — 63,1. Водночас у Coding Agent Index Astra виглядає значно краще: вона приблизно відповідає Fable 5 за якістю роботи агентів і може бути дешевшою на рівні окремої задачі завдяки меншій кількості вихідних токенів.
Точніше буде назвати GPT-6 Astra однією з найсильніших моделей для агентної роботи, а не безумовно найкращою в усіх можливих сценаріях. Її перевага — не окремий рекорд, а поєднання міркування, комп’ютерного керування, довгого контексту та здатності доводити завдання до результату.
Кібербезпека: головна сила і головне обмеження
GPT-6 Astra стала першою моделлю OpenAI, якій компанія присвоїла Critical-рівень кіберможливостей за власним Preparedness Framework. Це означає, що за наявності відповідних інструментів і доступу модель здатна знаходити невідомі раніше вразливості та будувати ланцюжки експлуатації без покрокового керування людиною.
У тестах без стандартних виробничих обмежень Astra набрала 100% на ExploitBench і 42,4% на ExploitGym, тоді як GPT-5.6 Sol показала 78,5% і 30,3% відповідно. OpenAI також повідомляє, що під час внутрішнього тестування модель знайшла дві раніше невідомі вразливості нульового дня.
Ця можливість має подвійне значення. Захисники можуть швидше знаходити й виправляти проблеми, але той самий рівень автоматизації підвищує ризик зловживань. Тому публічна версія Astra відмовляється від частини просунутих кіберзапитів, зокрема від створення proof-of-concept експлойтів. Для безпечніших сценаріїв — аудиту коду та підготовки патчів — доступ ширший.
В огляді безпеки OpenAI також визнає проблему моніторингу: у спеціально створених тестах Astra було важче відстежувати за письмовими міркуваннями, ніж GPT-5.6 Sol. Компанія пояснює це кращим контролем над ланцюжком міркувань і меншою кількістю записаних кроків. Для агентів, які діють у реальних системах, це принципове питання.
Коли і де буде доступна GPT-6 Astra
На старті OpenAI відкрила Astra обмеженій кількості організацій. У найближчі дні модель має з’явитися у користувачів ChatGPT Plus, Pro, Business та Enterprise, а також через OpenAI API, Microsoft Azure і AWS Bedrock. Для Enterprise доступ за замовчуванням вимкнений, його має активувати адміністратор. Користувачі Pro, Business та Enterprise також отримають окрему версію GPT-6 Astra Pro.
Стандартна ціна в API становить 10 доларів за 1 млн вхідних токенів і 50 доларів за 1 млн вихідних. Кешовані вхідні токени коштують 1 долар за мільйон. Fast-режим доступний за подвійною ціною, а для великих запитів із понад 272 тис. вхідних токенів діють підвищені тарифи. Деталі та актуальні обмеження наведено на сторінці моделі в OpenAI API.
Що це означає для користувачів
GPT-6 Astra зміщує фокус із «запитай — отримай текст» до «постав завдання — отримай виконаний процес». Найкраще це видно в Codex, роботі з документами, браузером і професійним програмним забезпеченням.
Але автономність не скасовує відповідальності людини. Перед запуском агента потрібно перевірити його дозволи, обмежити доступ до даних, закласти бюджет на токени та передбачити перевірку результатів. У юридичних, фінансових, медичних і кібербезпекових задачах остаточне рішення все одно має залишатися за фахівцем.
Запуск Astra справді є важливою подією для ринку ШІ. OpenAI представила дуже сильну модель, яка в окремих класах задач випереджає попереднє покоління з великим відривом. Та «найрозумніша у світі» — поки що маркетингове формулювання OpenAI, а не універсальний висновок усіх незалежних тестів.
Залишити коментар
Поділіться своєю думкою або поставте питання по темі статті.
Поки що коментарів немає. Будьте першим, хто залишить думку.