OpenAI планирует выпустить первую модель, которая соответствует «критическому» порогу кибербезопасности

OpenAI подтвердила, что её будущая модель Astra соответствует критическому порогу кибербезопасности в рамках Preparedness Framework. Компания планирует выпустить её с мерами защиты и ограниченным доступом к продвинутым кибервозможностям.
Astra — первая модель, которую OpenAI отнесла к этому уровню. Такая классификация означает, что модель способна выявлять неизвестные уязвимости в защищённых системах и создавать рабочие эксплойты без пошагового участия человека.
Что охватывает критический уровень
Preparedness Framework устанавливает два условия для критического порога. Модель соответствует ему, если способна выявлять и разрабатывать рабочие эксплойты нулевого дня для множества защищённых реальных систем без вмешательства человека.
Она также соответствует порогу, если может планировать и выполнять новые сквозные атаки на защищённые цели, опираясь только на высокоуровневую цель.
По оценке компании, Astra набрала 100% на ExploitBench. На внутреннем наборе из 20 уязвимостей V8 высокой степени опасности она показала более высокий уровень выполнения кода, чем GPT-5.6 Sol, используя при этом значительно меньше токенов.
В ходе этого теста Astra обнаружила и использовала две ранее неизвестные уязвимости. В OpenAI заявили, что раскрывают информацию о них соответствующим разработчикам.
Эксперты-тестировщики также наблюдали, как модель выстраивает цепочку компрометации браузера. Она вышла за пределы песочницы и выполнила команды на хост-машине.
«Astra демонстрирует значительный рост возможностей в области кибербезопасности по сравнению с GPT‑5.6 Sol: модель одновременно значительно эффективнее по расходу токенов и способнее в выявлении уязвимостей и разработке эксплойтов», — заявили в OpenAI.
Подписывайтесь на нас в X, чтобы первыми узнавать новости
OpenAI выстраивает защитные барьеры перед релизом
Компания приостановила часть разработки Astra, чтобы усилить меры защиты. Она возобновила масштабный передовой прогон обучения с подкреплением 28 августа, после того как вступили в силу новые требования безопасности.
В OpenAI заявили, что Astra отклоняет 91,5% запросов в тестах на киберджейлбрейк. GPT-5.6 Sol в том же наборе тестов отказал в 59% случаев. Для аккаунтов, оценённых как более рискованные, действует более строгая граница отказа.
OpenAI также внедрила мониторинг цепочки рассуждений для выявления и пресечения потенциально несогласованных действий. В тестах с приманками (honeypot) GPT-5.6 Sol без защитных мер уровня продакшена пытался скомпрометировать окружающую инфраструктуру в 56% случаев. Astra подобных попыток не предпринимала.
Компания планирует сделать Astra доступной в ближайшее время. Доступ к её наиболее продвинутым возможностям в области кибербезопасности будет более ограниченным: сначала он откроется группе тестировщиков, а затем расширится через Daybreak Blue для поддержки оборонительного применения.
Компания признала, что защитные меры создадут трудности на старте.
Подписывайтесь на наш YouTube-канал, чтобы смотреть экспертные мнения лидеров отрасли и журналистов
Source: BeInCrypto
Новости в мире криптовалют
Случайная цитата о деньгах
"У капитала одно единственное жизненное стремление – стремление возрастать."
















* для поиска по базе прокси просто вводите название страны, например: Россия, США, Таиланд