Компанията за изкуствен интелект на Илон Мъск пусна най-новия си флагмански AI-модел Grok 3, отговорът на xAI на “мислещите“ модели на OpenAI и китайския DeepSeek, който се рекламира като „страшно интелигентен AI“.
Отбелязва се, че за да обучи Grok 3, xAI използва огромен център за данни в Мемфис, който съдържа около 200 000 графични процесора. Самият Мъск отбеляза, че най-новият модел е създаден с „10 пъти“ по-голяма изчислителна мощност от Grok 2 и с разширен набор от данни за обучение, за който се твърди, че включва материали от съдебни дела.
„Grok 3 е с порядък по-мощен от Grok 2“, каза Мъск по време на презентация, излъчена в понеделник. „Това е AI, който търси истината колкото е възможно повече, дори ако тази истина понякога противоречи на това, което е политкоректно.“
Grok 3 не е отделен модел, а цяло семейство, което включва и по-малка версия — Grok 3 mini (който отговаря на въпроса по-бързо, но може да не е толкова точен). В момента само отделни модели са налични в бета-версия, докато пълното стартиране е обещано за понеделник.
Какви са резултатите от теста?
Според xAI, Grok 3 превъзхожда GPT-4o по бенчмаркове, включително AIME, който оценява производителността на модела по набор от математически въпроси, и GPQA, който оценява моделите, използвайки проблеми по физика, биология и химия на ниво докторантура. Съобщава се също, че ранната версия на Grok 3 е постигнала конкурентни резултати в тестовете на Chatbot Arena, които се противопоставят на различни AI-модели и събират потребителски оценки за техните отговори.

Двете вариации на Grok 3 – Grok 3 Reasoning и Grok 3 mini Reasoning – могат внимателно да „обмислят“ проблемите, подобно на „разсъждаващи модели“ като o3-mini на OpenAI и R1 на китайския DeepSeek. Разсъждаващите модели са известни с това, че внимателно се тестват преди публикуване на резултатите, което им позволява да избегнат някои от капаните, които обикновено измъчват стандартните модели.

Стартъпът на Мъск също така смело твърди, че Grok 3 Reasoning превъзхожда най-добрата версия на o3-mini, o3-mini-high — в няколко популярни теста, включително по-новия математически тест, наречен AIME 2025.
Достъпност
Моделите на разсъждение, които xAI популяризира като най-добри при обработката на заявки по математика, наука или програмиране, ще бъдат налични в уеб-приложението Grok или приложението за iOS – за по-сложните задачи са предвидени вариантите „Think“ и „Big Brain“ (последната от които включва „допълнително изчисление“), както и опция DeepSearch (като тази, представена наскоро от OpenAI).
Мъск отбеляза, че някои от „мислите“ на разсъждаващите модели в програмата ще бъдат скрити, за да се предотврати дестилацията —- техника, използвана в момента от разработчиците на AI-модели за заемане на данни от други модели. Наскоро OpenAI заподозря, че по този начин е обучен моделът DeepSeek, за който се твърди, че е взел данни от ChatGPT.

Grok 3 първоначално ще бъде достъпен за Premium+ абонатите на X, но за разширени функции вече има нов план, наречен SuperGrok, който за $30 на месец (или $300 на година) отключва допълнителни разсъждения и заявки към DeepSearch и позволява неограничено създаване на изображения.
След около седмица Grok 3 (и неговите предшественици) ще получи „гласов режим“, а след няколко седмици ще бъде включен в корпоративния API на xAI, заедно с функционалността DeepSearch. Мъск също обещава, че след няколко месеца ще отвори изходния код на Grok 2.
„Нашият подход е, че отваряме най-новата версия, когато следващата е напълно пусната. Когато Grok 3 стане зрял и стабилен, което е вероятно след няколко месеца, тогава ще стартираме Grok 2 като отворен код.„
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!