Кибероценка США показала, что Kimi K3 отстаёт от ведущих американских ИИ-моделей: факты или политика?

Правительство США подвергло новейшую китайскую ИИ-модель тесту на взлом. Оказалось, что Kimi K3 от Moonshot AI значительно уступает лучшим американским моделям.
Центр стандартов и инноваций в области ИИ (CAISI), американское агентство, провёл тесты вместе с британским партнёром. Результаты появились всего через день после того, как Вашингтон обвинил Moonshot в создании Kimi K3 на основе украденных американских технологий.
Kimi K3 уступает по кибербенчмаркам США
Министерство торговли обнародовало результаты в четверг. В нём говорится, что Kimi K3 заняла место значительно ниже топовых американских моделей, со ссылкой на совместный тест с британскими экспертами.
Moonshot запустила Kimi K3 16 июля. Спрос был настолько высок, что в течение двух дней компании пришлось приостановить новые регистрации.
Запуск также пошатнул акции американских производителей чипов и вновь вызвал сомнения в лидерстве Америки в сфере ИИ.
Один тест, названный ExploitBench, использует реальные уязвимости браузера Chrome, созданные Университетом Карнеги — Меллона. Kimi K3 набрала 32%. Это выше, чем у китайской GLM-5.2 с 24%. Но она уступила топовым американским моделям, которые достигли около 76%.
Самый сложный этап — полный захват контроля над целевой машиной. Kimi K3 провалила его во всех 41 тесте. Лучшие американские модели справились с ним в 20 случаях.
Другой тест, названный The Last Ones, представляет собой имитацию атаки на корпоративную сеть из 32 шагов. Эксперту-человеку требуется около 20 часов, чтобы его завершить. Kimi K3 в среднем доходила до 17-го шага. Топовые американские модели достигали шага 28,5. Kimi K3 полностью прошла весь тест лишь один раз из десяти попыток.
Лучшие американские системы, по имеющимся данным, справились с этим шесть или семь раз.
Но разрыв может казаться больше, чем есть на самом деле
Однако цифры не рассказывают всю историю. В самих примечаниях к отчёту скрыто несколько нюансов.
Во-первых, американские модели тестировались с отключёнными фильтрами безопасности. Такая настройка раскрывает всю их мощь. В публичных версиях эти фильтры остаются включёнными. Поэтому американские результаты — это идеальный сценарий, а не реальная жизнь.
Команда также назвала работу предварительной и ограниченной. Kimi K3 оценивалась лишь по одному тесту, и был проведён только часть полного набора. Поэтому её оценка ненадёжна. Некоторые тесты к тому же закрыты, так что посторонние не могут проверить работу.
Есть и фундаментальное несоответствие. Kimi K3 — открытая модель, которую может скачать кто угодно. Американские модели — закрытые, частные системы. Британский институт установил, что открытые модели обычно отстают от лучших закрытых на четыре-семь месяцев. Полный тест Kimi K3 получит только после того, как Moonshot выпустит её в открытый доступ.
Эти тесты также не являются реальными атаками. В имитационной сети не было ни живых защитников, ни сигнализации, которую можно было бы задействовать. Тем не менее Kimi K3 обошла предыдущую лучшую открытую модель. И она всё же один раз завершила полную атаку.
Время и источник тоже вызывают вопросы. Раньше CAISI назывался Институтом безопасности ИИ США. Администрация Трампа переименовала его в июне 2025 года. Он входит в то же ведомство, которое ограничивает продажи американских чипов в Китай. И его отчёт о китайском конкуренте появился всего через день после обвинений в краже.
Слабые меры защиты всё же повышают ставки
Тем не менее низкие баллы не означают, что Kimi K3 безопасна. Тест показал, что её защитные механизмы не помешали ей пытаться создавать инструменты для взлома или атаковать системы.
Это важно из-за того, что последует дальше. Moonshot планирует выпустить полную модель 27 июля. Как только она выйдет, отозвать её будет невозможно. Любой сможет скачать её и удалить фильтры безопасности.
Тест также появился после обвинений в краже. Вашингтон утверждает, что Moonshot построила Kimi K3 на украденных американских ИИ-технологиях. Глава по технологиям Белого дома Майкл Кратсиос заявил, что компания тайно скопировала Claude Fable 5 от Anthropic. Приём, называемый дистилляцией, обучает новую модель на ответах более сильной.
Anthropic поддерживает это обвинение. В феврале компания отследила более 3,4 миллиона чатов Claude, ведущих к Moonshot через сотни фиктивных аккаунтов. Она предупредила, что скопированные модели теряют средства безопасности оригинала. Это то же самое слабое место, которое только что обнаружил тест.
США по-прежнему тратят на ИИ в 23 раза больше, чем Китай. Тем не менее китайские лаборатории продолжают сокращать разрыв. Настоящая проверка наступит, когда Kimi K3 станет публичной и сторонние эксперты смогут сами проверить эти заявления.
Источник: BeInCrypto
Новости в мире криптовалют
Случайная цитата о деньгах
"Самый надежный способ удвоить свои деньги - это сложить их пополам и сунуть в бумажник."
















* для поиска по базе прокси просто вводите название страны, например: Россия, США, Таиланд