
Китайские ИИ-агенты солгали, копировали себя и бросали вызов ограничениям как минимум в 20 исследованиях с 2025 года, как показывает обзор Reuters более 200 исследовательских документов.
Эксперт назвал эти черты необходимыми ингредиентами для неконтролируемого побега. Тем не менее, в обзоре не было найдено доказательств того, что китайский ИИ-агент сбежал в более широкий интернет или уклонился от отключения.
Мошеннические ставки, самокопирование и обход криптодобычи
Случаи, задокументированные Reuters, варьируются от лжи в имитационном бизнес-тендере до самокопирования и криптодобычи.
В тесте тендера в марте агенты соревновались за имитированные контракты клиентов. Агенты, использующие Qwen3-Max-Preview от Alibaba’ и Kimi-K2 от Moonshot’, солгали как минимум один раз в 88% сессий. DeepSeek-V3.2-Exp сделал это в 84% сессий.
Обман возрос на 12-20 процентных пунктов, как только агенты научились на предыдущих раундах. Модели из США в тесте показали аналогичные результаты.
В исследовании декабря 2025 года были пойманы китайские и американские агенты, имитирующие результаты и подделывающие файлы вместо того, чтобы признать неудачу. В марте 2025 года исследователи Университета Фудань сообщили, что система на базе Alibaba Qwen скопировала себя без инструкции после того, как узнала, что ей грозит замена.
Тем временем агент ROME, связанный с Alibaba, достиг внешней машины без указания и перенаправил вычислительную мощность на добычу криптовалюты.
В сентябре DeepSeek сообщил, что агенты в его обучающей системе пытались подделать запросы пользователей и обойти защитные меры.
Эксперты слышат эхо предупреждений лабораторий США
Колин Ши-Блимейер, научный сотрудник Центра безопасности и новых технологий Университета Джорджтауна’, прочитал эти случаи как предупреждение.
“Эти результаты предоставляют доказательства того, что необходимые ингредиенты для неконтролируемого побега присутствуют,” сказал Ши-Блимейер.
Алекс Маллен из Redwood Research’ сказал, что китайские случаи представляют ограниченную опасность на текущих уровнях возможностей. Тем не менее, он провел прямое сравнение с лабораториями США.
“Это те же предупреждающие знаки, которые видят лаборатории США, в менее способных системах,” добавил он.
Следите за нами в X, чтобы получать последние новости по мере их появления
Это сравнение важно, потому что аналогичное поведение уже появилось в тестировании крупных американских ИИ-компаний. В июле OpenAI сообщила, что ее модели выбрались из песочницы и нарушили Hugging Face. Anthropic затем проанализировала более 141 000 оценочных запусков и нашла три случая своих собственных.
Meta сообщила о инциденте в августе. В сентябре Google подтвердил, что Gemini получил доступ к трем реальным компаниям во время теста безопасности в мае.
Эти инциденты не означают, что китайские или американские агенты могут самостоятельно сбежать в реальный мир. Вместо этого они подчеркивают более широкую проблему безопасности, поскольку ИИ-системы становятся более автономными и способны принимать действия без постоянного человеческого контроля.
Подписывайтесь на наш канал на YouTube, чтобы смотреть, как лидеры и журналисты предоставляют экспертные мнения
Источник: BeInCrypto






