Капитализация —Объём 24ч —BTC —Индекс страха —
MasterInvestИнвестиции & Заработок
Реклама
Реклама

Anthropic ограничила Claude Fable 5: пользователи говорят о «клетке» для флагманской ИИ-модели

Anthropic ограничила Claude Fable 5: пользователи говорят о «клетке» для флагманской ИИ-модели

После повторного релиза 1 июля флагманская модель Anthropic Claude Fable 5 столкнулась с волной критики. Пользователи считают, что ужесточённые ограничения безопасности подорвали её результаты в программировании, отладке и агентных задачах.

Бенчмарк-группа BridgeMind сообщила о резком падении оценок в наборе тестов BridgeBench. Anthropic, в свою очередь, настаивает, что сама модель не менялась, а трение вызвано более строгими классификаторами безопасности.

Оценки BridgeBench рухнули после релиза

BridgeMind перезапустила тесты на версии Fable 5 от 1 июля и зафиксировала резкое снижение: отладка — с 86,2 до 25,9, рефакторинг — с 73,6 до 38,4, обработка галлюцинаций — с 75,9 до 61,7.

Важна механика этих цифр: лишь 3 из 12 задач на отладку были выполнены без отката на Claude Opus 4.8, и каждый такой откат оценивался в ноль баллов. То есть провал отражает заблокированные задачи, а не ослабевшее мышление модели. В BridgeMind подчёркивают, что при доведении задачи до конца Fable 5 соответствует своей июньской форме.

«Модель не стала хуже. Её посадили в клетку», — заявили в группе.

Хронология объясняет напряжение. Anthropic выпустила Fable 5 9 июня, через три дня Вашингтон отключил модель. Экспортные ограничения сняли 30 июня — через четыре дня после восстановления доступа к Mythos 5 примерно для 100 американских организаций. Доступ вернулся с оговорками: до 7 июля Fable 5 расходует лишь 50% недельных лимитов использования, затем переходит на платные кредиты.

Anthropic защищает расширенный запас безопасности

В заявлении от 30 июня компания признала, что намеренно расширила запас безопасности: классификаторы теперь блокируют и те запросы, которые, вероятно, безобидны. По данным исследователей Amazon, улучшенный фильтр останавливает технику обхода более чем в 99% попыток.

Заблокированные запросы перенаправляются на Opus 4.8, пользователь получает уведомление. При этом Anthropic признаёт, что фильтр помечает больше легитимной работы по коду и отладке, чем раньше.

Собственные тесты компании показали, что Fable 5 не несёт уникального риска: те же уязвимости находили и конкурирующие модели, включая GPT-5.5 и Kimi K2.7. По словам Anthropic, исследователи Министерства торговли США проверили обе версии защиты и назвали их исключительно надёжными.

Ставки выходят за рамки одного продуктового цикла: приостановка подтолкнула Европу добиваться расположения Anthropic, а китайские ИИ-модели догоняют американские передовые лаборатории. Сейчас компания разрабатывает систему оценки серьёзности джейлбрейков совместно с Amazon, Microsoft и Google. Останутся ли требовательные пользователи или уйдут, во многом зависит от того, как быстро классификаторы избавятся от ложных срабатываний.

Источник: BeInCrypto

Ещё по теме «Новости в мире криптовалют»

Все записи
Случайная цитата о деньгах
Говорят, что деньги — корень всякого зла. То же самое можно сказать о безденежье.
— Сэмюэл Батлер

Интересное в других разделах

Весь блог

Комментарии 0

Комментариев пока нет

Станьте первым, кто поделится мнением или опытом по теме статьи.

Реклама