Google выпустила свою самую продвинутую аудиомодель. Вот какое у неё место

Google 15 сентября выпустила Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking, назвав их своими самыми продвинутыми аудиомоделями.
Обе модели говорят, рассуждают и выполняют задачи. Но какое место им отводят независимые аналитики? Версия Extended Thinking возглавила Speech-to-Speech Index от Artificial Analysis с результатом 82,6, обойдя GPT-Live-1 и Grok Voice.
Подписывайтесь на нас в X, чтобы узнавать новости первыми
Какое место бенчмарки отводят новейшей разговорной ИИ-модели Google
Индекс Artificial Analysis усредняет речевое рассуждение, агентские способности, предпочтения на арене и долю успешно выполненных задач.
Gemini 3.8 Live Extended Thinking, протестированная на высоком уровне усилий рассуждения, дебютировала на первом месте. Следом идут GPT-Live-1 Astra с 81,5 и Grok Voice Think Fast 2.0 High с 81,3.
Обычная Gemini 3.8 Live заняла пятое место с результатом 76,0. Оба варианта обошли Gemini 3.1 Flash Live High, набравшую 71,5.
Разрыв в агентских задачах шире. Extended Thinking достигла 68,6% в бенчмарке Tau Voice против 37,7% у предыдущего поколения.
В бенчмарке речевого рассуждения Extended Thinking набрала 97,7%, чуть опередив Grok Voice с 97,2%. Однако она уступила Qwen Audio 3.0 Realtime Plus с результатом 99,2%.
Живые тестировщики всё ещё тянутся к прежней модели Gemini
Цена — там, где разрыв открывается. Обычная модель обходится в 0,84 доллара за час входящего аудио. Это примерно вдвое меньше 1,75 доллара у предшественницы и самая низкая ставка в индексе.
Extended Thinking стоит 3,50 доллара в час. Это дешевле GPT-Live-1 Sol с 4,47 доллара и Grok Voice Think Fast 2.0 High с 4,80.
Задержка тоже снизилась. Среднее время до первого звука упало до 1,18 секунды против 2,99 секунды у прежней модели Gemini.
Слушатели, впрочем, убеждены не до конца. Gemini 3.1 Flash Live по-прежнему лидирует по предпочтениям в слепых диалогах Speech Agent Arena с рейтингом Эло 1096.
Gemini 3.8 Live идёт второй с 1083. Вариант Extended Thinking отстаёт с 990, несмотря на 89,1% выполненных задач.
Голосовой ИИ сейчас оценивают по двум шкалам, которые указывают в разные стороны. Бенчмарки награждают модель, которая рассуждает усерднее. Предпочтения — ту, которая говорит лучше. Google сейчас лидирует в обеих, но разными моделями.
Подпишитесь на наш канал на YouTube, чтобы смотреть экспертные разборы от лидеров отрасли и журналистов
Source: BeInCrypto
Новости в мире криптовалют
Случайная цитата о деньгах
"Деньги не приносят счастья, но очень помогают без него обойтись."
















* для поиска по базе прокси просто вводите название страны, например: Россия, США, Таиланд