Anthropic ограничила Claude Fable 5: пользователи говорят о «клетке» для флагманской ИИ-модели

После повторного релиза 1 июля флагманская модель Anthropic Claude Fable 5 столкнулась с волной критики. Пользователи считают, что ужесточённые ограничения безопасности подорвали её результаты в программировании, отладке и агентных задачах.
Бенчмарк-группа BridgeMind сообщила о резком падении оценок в наборе тестов BridgeBench. Anthropic, в свою очередь, настаивает, что сама модель не менялась, а трение вызвано более строгими классификаторами безопасности.
Оценки BridgeBench рухнули после релиза
BridgeMind перезапустила тесты на версии Fable 5 от 1 июля и зафиксировала резкое снижение: отладка — с 86,2 до 25,9, рефакторинг — с 73,6 до 38,4, обработка галлюцинаций — с 75,9 до 61,7.
Важна механика этих цифр: лишь 3 из 12 задач на отладку были выполнены без отката на Claude Opus 4.8, и каждый такой откат оценивался в ноль баллов. То есть провал отражает заблокированные задачи, а не ослабевшее мышление модели. В BridgeMind подчёркивают, что при доведении задачи до конца Fable 5 соответствует своей июньской форме.
«Модель не стала хуже. Её посадили в клетку», — заявили в группе.
Хронология объясняет напряжение. Anthropic выпустила Fable 5 9 июня, через три дня Вашингтон отключил модель. Экспортные ограничения сняли 30 июня — через четыре дня после восстановления доступа к Mythos 5 примерно для 100 американских организаций. Доступ вернулся с оговорками: до 7 июля Fable 5 расходует лишь 50% недельных лимитов использования, затем переходит на платные кредиты.
Anthropic защищает расширенный запас безопасности
В заявлении от 30 июня компания признала, что намеренно расширила запас безопасности: классификаторы теперь блокируют и те запросы, которые, вероятно, безобидны. По данным исследователей Amazon, улучшенный фильтр останавливает технику обхода более чем в 99% попыток.
Заблокированные запросы перенаправляются на Opus 4.8, пользователь получает уведомление. При этом Anthropic признаёт, что фильтр помечает больше легитимной работы по коду и отладке, чем раньше.
Собственные тесты компании показали, что Fable 5 не несёт уникального риска: те же уязвимости находили и конкурирующие модели, включая GPT-5.5 и Kimi K2.7. По словам Anthropic, исследователи Министерства торговли США проверили обе версии защиты и назвали их исключительно надёжными.
Ставки выходят за рамки одного продуктового цикла: приостановка подтолкнула Европу добиваться расположения Anthropic, а китайские ИИ-модели догоняют американские передовые лаборатории. Сейчас компания разрабатывает систему оценки серьёзности джейлбрейков совместно с Amazon, Microsoft и Google. Останутся ли требовательные пользователи или уйдут, во многом зависит от того, как быстро классификаторы избавятся от ложных срабатываний.
Источник: BeInCrypto
Новости в мире криптовалют
Случайная цитата о деньгах
"Деньги - очень полезная штука. Они позволяют не делать того, чего ты не любишь делать, а я не люблю делать почти ничего."















* для поиска по базе прокси просто вводите название страны, например: Россия, США, Таиланд