Google и Meta выпустили конкурирующие ИИ-модели с разницей в несколько часов: кто лидирует?

Google и Meta выпустили свои новейшие передовые ИИ-модели с разницей в несколько часов в среду. Google представила Gemini 3.8 Flash вместе с версией для кибербезопасности, а Meta выпустила Muse Spark 1.3.
Эти два релиза напрашиваются на прямое сравнение. Независимое тестирование Artificial Analysis разделило результаты. Meta лидирует в агентной работе со знаниями и научном мышлении, тогда как Google имеет преимущество в точности фактов и терминальном кодинге.
Два передовых релиза выходят в один день
Gemini 3.8 Flash — третий релиз линейки Flash от Google за шесть недель. Модель стоит $0,75 за 1 миллион входных токенов и $3,75 за 1 миллион выходных токенов.
Подписывайтесь на нас в X, чтобы получать последние новости в реальном времени
Эта вводная цена действует до 31 декабря 2026 года. После этого цены удвоятся — до $1,50 и $7,50 за 1 миллион токенов.
Google дополнила базовую модель версией Gemini 3.8 Flash Cyber. Модель доступна ограниченному кругу доверенных специалистов по защите. Она набрала 86,2% в CyberGym — тесте на поиск уязвимостей.
Кибер-версия также достигла 47,2% в CWE-Bench — тесте на устранение уязвимостей (патчинг). По данным Google, модель создавала в 2,6 раза больше корректных патчей для уязвимостей Chrome, чем более крупные коммерческие модели.
Доступ предоставляется в рамках программы Fairwind, которая ограничивает использование модели государственными структурами и операторами критической инфраструктуры. Днём ранее аналогичную границу провела OpenAI в отношении Astra — первой модели, которую компания отнесла к критическому уровню угрозы кибербезопасности.
Тем временем Meta выпустила Muse Spark 1.3 через Muse Code и Meta Model API. По данным инженеров компании, число вызовов инструментов сократилось примерно на 20% по сравнению с версией 1.2.
Gemini 3.8 Flash против Muse Spark 1.3: независимые тесты разделили результаты
Artificial Analysis протестировала обе модели, и результаты показывают их расстановку. Muse Spark 1.3 в режиме max набрала 1754 очка Elo в GDPval-AA v2. Gemini 3.8 Flash (high) показала 1545.
Meta также лидировала в тесте банковского агента Sierra Research (52,4% против 44,9%) и в тесте физического мышления CritPt. Gemini 3.8 Flash лидировала в Terminal-Bench 2.1 с результатом 87,6%, в тесте длинного контекста AA-LCR с 81% и в точности AA-Omniscience с 55%.
Gemini 3.8 Flash показала наивысший результат GPQA Diamond среди протестированных моделей — 95%. В тесте Humanity’s Last Exam модели разошлись менее чем на один балл.
Лучший результат Meta пока недоступен. По словам компании, режим max reasoning появится после завершения дополнительного тестирования безопасности, а пока доступна версия xhigh.
Эта версия набрала 61 балл в индексе Artificial Analysis Intelligence Index — на четыре балла больше, чем Muse Spark 1.2. Она уступает Claude Fable 5.1 с 66 баллами и Claude Opus 5 с 63 баллами.
В очереди уже находятся новые релизы. Илон Маск заявил, что Grok 4.7 выйдет в ближайшее время, и тогда за две недели состоится четыре релиза передовых моделей.
Подпишитесь на наш YouTube-канал, чтобы смотреть экспертные мнения лидеров отрасли и журналистов
Source: BeInCrypto
Новости в мире криптовалют
Случайная цитата о деньгах
"Тот, кто платит поздно, никогда не платит дважды."
















* для поиска по базе прокси просто вводите название страны, например: Россия, США, Таиланд