Google пусна Gemini 3.8 Live – гласов асистент, който разбира 97 езика и продължава да работи, докато му говорите. Компанията показа две версии едновременно. Gemini 3.8 Live е предназначен за бързи отговори и малки задачи. Extended Thinking е по-подходящ за сложните въпроси, които изискват мислене и предприемане на няколко стъпки, казва Google.
Какво може да прави Gemini 3.8 Live?
- И двата модела вече са налични в Google Search, приложенията Workspace и услугата за разработчици Google AI Studio;
- Основната новина е проста: асистентът вече може да прави нещо във фонов режим, докато му говорите. Например, да търси информация, да отваря услуги или да осъществява достъп до други програми и същевременно няма да мълчи;
- Освен това вижда това, което показвате с камерата на телефона си, отговаря на въпроси за това, което виждате, и превключва от един език на друг в движение, точно по средата на изречението;
- ИИ моделът разбира 97 езика и превключва между тях, когато събеседникът ги смесва в разговор;
- Той също така преобразува ръчно рисуваните скици в работещи части от код на сайт.
Според собствените тестове на Google, Gemini 3.8 Live Extended Thinking се класира на първо място в класацията за качество на гласа Artificial Analysis с резултат от 82,6%. Опростената версия се класира на второ място в Speech Agent Arena.
При сравняване на гласови асистенти от различни компании, моделът на Google изглежда като един от най-силните варианти на пазара. Компанията е отворила отделен Gemini Live API за разработчиците, а през март вече е наличен опростения модел Gemini 3.1 Flash-Lite за лесните и бързи заявки.
Преди това ви разказахме как Gemini Live се научи да гледа в камерата и екрана на смартфона, а сега тази функция е станала по-умна. Същевременно, Gemini Live вече е достъпен безплатно за всички Android-потребители
Къде можете да изпробвате Gemini 3.8 Live?
Моделът Gemini може да бъде изпробван в Google Search чрез Search Live, където се разпространява глобално. В Gmail, Google Docs и Keep за тези с абонамент за Workspace.
Моделът е достъпен в Google AI Studio за разработчиците, които искат да добавят глас към своите продукти. Всички генерирани от модела аудио-файлове включват дискретен воден знак SynthID, за да се изясни, че гласът е създаден от изкуствен интелект, а не от жив човек.
Българските потребители ще получат гласов асистент, който разбира български език и превключва на английски без отделен бутон.
Малкият бизнес може да интегрира такъв асистент в своето приложение или уебсайт чрез API, така че клиентите да получават отговори чрез глас, а не чрез чат.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!