Google випустила свою найпросунутішу аудіомодель. Ось яке в неї місце

Google 15 вересня випустила Gemini 3.8 Live і Gemini 3.8 Live Extended Thinking, назвавши їх своїми найпросунутішими аудіомоделями.
Обидві моделі говорять, міркують і виконують завдання. Але яке місце їм відводять незалежні аналітики? Версія Extended Thinking очолила Speech-to-Speech Index від Artificial Analysis з результатом 82,6, обійшовши GPT-Live-1 і Grok Voice.
Підписуйтесь на нас у X, щоб дізнаватися новини першими
Яке місце бенчмарки відводять найновішій розмовній ШІ-моделі Google
Індекс Artificial Analysis усереднює мовленнєве міркування, агентські здібності, уподобання на арені та частку успішно виконаних завдань.
Gemini 3.8 Live Extended Thinking, протестована на високому рівні зусиль міркування, дебютувала на першому місці. Слідом ідуть GPT-Live-1 Astra з 81,5 і Grok Voice Think Fast 2.0 High з 81,3.
Звичайна Gemini 3.8 Live посіла п’яте місце з результатом 76,0. Обидва варіанти обійшли Gemini 3.1 Flash Live High, що набрала 71,5.
Розрив в агентських завданнях ширший. Extended Thinking досягла 68,6% у бенчмарку Tau Voice проти 37,7% у попереднього покоління.
У бенчмарку мовленнєвого міркування Extended Thinking набрала 97,7%, трохи випередивши Grok Voice з 97,2%. Проте вона поступилася Qwen Audio 3.0 Realtime Plus із результатом 99,2%.
Живі тестувальники все ще тягнуться до попередньої моделі Gemini
Ціна — там, де розрив відкривається. Звичайна модель обходиться у 0,84 долара за годину вхідного аудіо. Це приблизно вдвічі менше за 1,75 долара в попередниці й найнижча ставка в індексі.
Extended Thinking коштує 3,50 долара на годину. Це дешевше за GPT-Live-1 Sol із 4,47 долара і Grok Voice Think Fast 2.0 High із 4,80.
Затримка теж знизилася. Середній час до першого звуку впав до 1,18 секунди проти 2,99 секунди в попередньої моделі Gemini.
Слухачі, втім, переконані не до кінця. Gemini 3.1 Flash Live і далі лідирує за вподобаннями у сліпих діалогах Speech Agent Arena з рейтингом Ело 1096.
Gemini 3.8 Live іде другою з 1083. Варіант Extended Thinking відстає з 990, попри 89,1% виконаних завдань.
Голосовий ШІ зараз оцінюють за двома шкалами, які вказують у різні боки. Бенчмарки нагороджують модель, що міркує старанніше. Уподобання — ту, що говорить краще. Google зараз лідирує в обох, але різними моделями.
Підпишіться на наш канал на YouTube, щоб дивитися експертні розбори від лідерів галузі та журналістів
Source: BeInCrypto
Новини у світі криптовалют
Випадкова цитата про гроші
"Все преимущество иметь деньги заключается в возможности ими пользоваться."














* для пошуку по базі проксі просто вводьте назву країни, наприклад: Росія, США, Таїланд