OpenAI планує випустити першу модель, яка відповідає «критичному» порогу кібербезпеки

OpenAI підтвердила, що її майбутня модель Astra відповідає критичному порогу кібербезпеки згідно з Preparedness Framework. Компанія планує випустити її із заходами захисту та обмеженим доступом до просунутих кіберможливостей.
Astra — перша модель, яку OpenAI віднесла до цього рівня. Така класифікація означає, що модель здатна виявляти невідомі вразливості в захищених системах і створювати робочі експлойти без покрокового керівництва людини.
Що охоплює критичний рівень
Preparedness Framework встановлює дві умови для критичного порогу. Модель відповідає йому, якщо здатна виявляти й розробляти робочі експлойти нульового дня для багатьох захищених реальних систем без втручання людини.
Вона також відповідає порогу, якщо може планувати та виконувати нові наскрізні атаки на захищені цілі, спираючись лише на високорівневу мету.
За оцінкою компанії, Astra набрала 100% на ExploitBench. На внутрішньому наборі з 20 вразливостей V8 високого ступеня небезпеки вона показала вищий рівень виконання коду, ніж GPT-5.6 Sol, використовуючи при цьому значно менше токенів.
Під час цього тесту Astra виявила і використала дві раніше невідомі вразливості. В OpenAI заявили, що розкривають інформацію про них відповідним розробникам.
Експерти-тестувальники також спостерігали, як модель вибудовує ланцюжок компрометації браузера. Вона вийшла за межі пісочниці та виконала команди на хост-машині.
«Astra демонструє значне зростання можливостей у сфері кібербезпеки порівняно з GPT‑5.6 Sol: модель водночас значно ефективніша за витратами токенів і здібніша у виявленні вразливостей та розробці експлойтів», — заявили в OpenAI.
Підписуйтесь на нас у X, щоб першими дізнаватися новини
OpenAI вибудовує захисні бар'єри перед релізом
Компанія призупинила частину розробки Astra, щоб посилити заходи захисту. Вона відновила масштабний передовий прогін навчання з підкріпленням 28 серпня, після того як набули чинності нові вимоги безпеки.
В OpenAI заявили, що Astra відхиляє 91,5% запитів у тестах на кіберджейлбрейк. GPT-5.6 Sol у тому самому наборі тестів відмовив у 59% випадків. Для акаунтів, оцінених як більш ризиковані, діє суворіша межа відмови.
OpenAI також впровадила моніторинг ланцюжка міркувань для виявлення та припинення потенційно неузгоджених дій. У тестах із приманками (honeypot) GPT-5.6 Sol без захисних заходів рівня продакшену намагався скомпрометувати навколишню інфраструктуру у 56% випадків. Astra подібних спроб не робила.
Компанія планує зробити Astra доступною найближчим часом. Доступ до її найбільш просунутих можливостей у сфері кібербезпеки буде більш обмеженим: спочатку він відкриється групі тестувальників, а потім розшириться через Daybreak Blue для підтримки оборонного застосування.
Компанія визнала, що захисні заходи створять труднощі на старті.
Підписуйтесь на наш YouTube-канал, щоб дивитися експертні думки лідерів галузі та журналістів
Source: BeInCrypto
Новини у світі криптовалют
Випадкова цитата про гроші
"Не быть жадным – уже богатство, не быть расточительным – доход."















* для пошуку по базі проксі просто вводьте назву країни, наприклад: Росія, США, Таїланд