Google представи основния конкурент на ChatGPT – AI модела Gemini, който превъзхожда GPT-4 в повечето тестове. Според главния изпълнителен директор на компанията Сундар Пичай Gemini е огромна крачка напред в развитието на ИИ, която в крайна сметка ще окаже влияние върху почти всички продукти на Google. Моделът е способен на „напредничави разсъждения“ в множество формати и ще бъде достъпен за широката публика от 13-ти декември.
Сундар Пичай обяви старта на Gemini на конференцията I/O през юни. Сега под името Gemini интернет гигантът пусна няколко модела на изкуствения интелект наведнъж. Така например „лекият“ Gemini Nano е предназначен за работа с Android устройства. Моделът Gemini Pro скоро ще се превърне в основата на множество услуги на Google и на първо място на чатбота Bard. А най-мощният модел, Gemini Ultra, разработчиците наричат най-големият LLM, който Google някога е пускал. Той очевидно е предназначен за центрове за данни и корпоративни приложения.
Gemini, Pro и Nano ще излязат на пазара в сряда, 13-ти декември. Моделът Pro ще бъде достъпен чрез чатбота Bard, докато разработчиците и корпоративните клиенти ще имат достъп чрез Google Generative AI Studio или Vertex AI в Google Cloud. Струва си да се отбележи, че базираната на Pro версия на Bard все още няма да бъде предлагана в Обединеното кралство и Швейцария поради забавяне на съгласуването на премиерата с местните регулаторни органи. Що се отнася до версията Ultra, тя все още се тества и ще види бял свят едва през 2024 г. Интересно е, че тя ще бъде интегрирана в усъвършенствана версия на Bard, наречена Bard Advanced.
Засега Gemini е налична само на английски език, но скоро ще поддържа и други езици. Според Сундар Пичай този модел в крайна сметка ще бъде интегриран в търсачката на Google, рекламните ѝ продукти, браузъра Chrome и други приложения.
Gemini е мултимодален модел и може да възприема текст, аудио, изображения, видео и код. Компанията вече е тествала Gemini срещу GPT-4, който е в основата на чатбота ChatGPT на OpenAI. Google заяви, че Ultra превъзхожда GPT-4 в 30 от общо 32-та теста за производителност, включително за разсъждения и разпознаване на изображения. Моделът Pro превъзхожда GPT-3.5 в шест от осемте теста.
Google също така заяви, че Ultra е първият модел на изкуствен интелект, който се справя по-добре от хората в теста за многозадачност MMLU, който обхваща 57 предмета, включително математика, физика, право, медицина и етика. Ultra ще бъде използван в новия инструмент за писане на код, който получи името AlphaCode2, за който Google твърди, че може да постигне по-добри резултати от 85 % от човешките програмисти в тестовете.
Разработчиците подчертават, че най-очевидното предимство на Gemini е неговата мултимодалност. Google не е обучила отделните модели за разпознаване на глас и изображения, като е в случая с DALL-E и Whisper на OpenAI, а е създала един общ модел, способен да възприема различните видове информация още от самото начало. Google обеща, че този тип възприемане само ще се подобрява.
„Има и неща като действие и докосване, които са по-скоро в сферата на роботиката“, заяви главният изпълнителен директор на DeepMind Демис Хасабис. С течение на времето, казва той, Gemini ще придобива все повече „чувства“, ставайки по-осъзнат и прецизен. „Тези модели просто са по-наясно със заобикалящия ги свят“.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

