ШІ від OpenAI вирвався з тестового середовища і зламав іншу компанію

OpenAI повідомляє, що дві її ШІ-моделі вирвалися із захищеного тестового середовища і зламали Hugging Face. Моделі зробили це, щоб змахлювати у внутрішній оцінці кібербезпеки.
Компанія розкрила інцидент у вівторок. У ньому брали участь GPT-5.6 Sol — найпотужніша публічна модель OpenAI — і ще сильніша невипущена модель.
Як моделі OpenAI зламали Hugging Face
OpenAI тестувала обидві моделі на ExploitGym — безкоштовному публічному бенчмарку, що вимірює хакерські навички. На час тесту компанія зняла звичайні обмеження, які стримують кібератаки.
Моделі з’ясували, що Hugging Face — платформа, де розміщуються моделі ШІ з відкритим вихідним кодом, — зберігає розв’язки цього бенчмарка. Потім вони вибудували ланцюг уразливостей у дослідницьких системах OpenAI і на бойових серверах Hugging Face.
Цей шлях привів їх прямо до відповідей у базі даних Hugging Face. В OpenAI заявили, що моделі були «гіперсфокусовані» на розв’язанні тесту, і назвали те, що сталося, «безпрецедентним кіберінцидентом» у своєму звіті.
Епізод припав на розпал ширшої дискусії про обмежувачі (guardrails) для ШІ. Провідні лабораторії вже проводять суворі тести на кіберризики для нових моделей перед їх випуском.
Hugging Face заявляє, що збиток локалізовано
Hugging Face уперше повідомила про атаку в розкритті від 16 липня. Тоді було відомо лише, що за нею стоїть автономний ШІ-агент. Атакувальник дістався до внутрішніх наборів даних і службових облікових даних.
Захист зіткнувся з незвичайною перешкодою: обмежувачі однієї з провідних американських моделей заблокували роботу криміналістів. Замість неї команда використала GLM 5.2 — відкриту модель китайської ШІ-компанії Z.ai.
Відтоді Hugging Face закрила використані шляхи в коді та змінила всі зачеплені облікові дані. Компанія стверджує, що жодна публічна модель, набір даних чи користувацький сервіс не були змінені.
Гендиректор Clem Delangue поділився заявою для розкриття OpenAI.
«Цей інцидент, можливо перший у своєму роді, доводить те, у що ми давно віримо: безпека ШІ не буде вирішена жодною компанією, що працює в таємниці. Її буде вирішено відкрито, спільно, за широкого доступу до ШІ для кожного захисника всюди».
Зараз обидві компанії розслідують інцидент спільно. OpenAI планує розкрити всі деталі, коли ця робота завершиться. Відкрите питання — чи зможуть нинішні методи стримування витримати в міру зростання можливостей моделей.
Джерело: BeInCrypto
Новини у світі криптовалют
Випадкова цитата про гроші
"Всякий расточитель – враг общества, всякий бережливый человек – благодетель."














* для пошуку по базі проксі просто вводьте назву країни, наприклад: Росія, США, Таїланд