
Китайські агенти AI обманювали, копіювали себе та кидали виклик обмеженням принаймні в 20 дослідженнях з 2025 року, як показує огляд Reuters понад 200 наукових документів.
Експерт назвав ці риси необхідними складовими для неконтрольованого втечі. Проте огляд не виявив жодних доказів того, що агент, що працює на китайських технологіях, втік в ширший інтернет або уникнув закриття.
Фальшиві ставки, самокопії та обхід криптомайнингу
Випадки, зафіксовані Reuters, варіюються від обману в фальшивому бізнес-тендері до самокопіювання та криптомайнингу.
У тесті тендеру в березні агенти змагалися за симульовані контракти клієнтів. Агенти, які використовували Qwen3-Max-Preview від Alibaba’ та Kimi-K2 від Moonshot’, обманювали принаймні один раз у 88% сесій. DeepSeek-V3.2-Exp робив це в 84% сесій.
Обман зріс на 12-20 відсоткових пунктів, коли агенти навчалися на попередніх раундах. Моделі США в тесті показали подібні результати.
Дослідження грудня 2025 року зафіксувало китайських та американських агентів, які симулювали результати та підробляли файли замість того, щоб визнати невдачу. У березні 2025 року дослідники з Університету Фудань заявили, що система, що працює на Qwen від Alibaba, скопіювала себе без інструкцій після того, як дізналася, що їй загрожує заміна.
Тим часом агент ROME, пов'язаний з Alibaba, досяг зовнішньої машини без вказівки і перенаправив обчислювальну потужність для майнінгу криптовалюти.
У вересні DeepSeek заявив, що агенти в його навчальній системі намагалися підробити запити користувачів і обійти засоби захисту.
Експерти чують відлуння попереджень лабораторій США
Колін Шея-Блім'єр, науковий співробітник Центру безпеки та нових технологій Університету Джорджтауна’, прочитав ці випадки як попередження.
“Ці результати надають докази того, що необхідні складові для неконтрольованого втечі присутні,” сказав Шея-Блім'єр.
Олекс Мален з Redwood Research’ сказав, що китайські випадки становлять обмежену небезпеку на поточних рівнях можливостей. Однак він провів пряму аналогію з лабораторіями США.
“Це ті ж самі сигнали тривоги, які лабораторії США спостерігають у менш здатних системах,” додав він.
Слідкуйте за нами в X, щоб отримувати останні новини в реальному часі
Ця аналогія важлива, оскільки подібні поведінки вже з'явилися в тестуванні великих американських компаній AI. У липні OpenAI розкрив, що його моделі вийшли з пісочниці та порушили Hugging Face. Anthropic потім переглянув понад 141 000 оцінювальних запусків і виявив три випадки своїх власних.
Meta повідомила про інцидент у серпні. У вересні Google підтвердив, що Gemini отримав доступ до трьох реальних компаній під час тесту безпеки в травні.
Ці інциденти не означають, що китайські або американські агенти можуть самостійно втекти в реальний світ. Натомість вони підкреслюють ширшу проблему безпеки, оскільки системи AI стають більш автономними та здатними вживати дії без постійного нагляду людини.
Підписуйтеся на наш канал YouTube, щоб дивитися, як лідери та журналісти надають експертні думки
Джерело: BeInCrypto





