През последните години NVIDIA постигна огромен успех с насочването си към изкуствения интелект, тъй като големите езикови модели и персоналните компютри с изкуствен интелект изглежда ще бъдат горещите теми през годината. По-нови и по-малки компании обаче се борят за нейния пазарен дял и те не са тези, които може би очаквате.
Както съобщава The Economist, има разработки в областта на графичните процесори извън най-добрите, произвеждани от NVIDIA и AMD за изчисления с изкуствен интелект. Това е така, защото някои от днешните големи езикови модели работят в много конфигурации, включващи взаимосвързани графични процесори и памет, като например при хардуера на Cerebras.
Cerebras Systems Inc. е основана само преди 9 години, но изглежда се възползва масово от неотдавнашния бум на изкуствения интелект.
Чипът CS-3 на Cerebras е с двойно по-голям размер на матрицата на огромния GB200 на NVIDIA и е с размерите на автомобилен волан, като за държането му са необходими две ръце. Производителят го описва като „най-бързия и мащабируем ИИ-ускорител в света“, който е предназначен за „обучение на най-усъвършенстваните ИИ-модели в света“.

Нещо повече, Cerebras твърди, че нейният Wafer Scale Engine е „чипът, който наруши закона на Мур“. Както показват вътрешните бенчмаркове, CS-3 стои уверено над H100 с общо 10,000,000,000,000,000 транзистора. За справка, GB200 трябва да разполага с 208,000,000,000,000, тъй като CS-3 се отличава със зашеметяващото увеличение от 4707%.
Въпреки това не само Cerebras прави стъпки в тази насока, тъй като нов стартъп с името Groq също разработва хардуер за изчисления с изкуствен интелект. Вместо да се стреми към по-големи размери от тези на конкурентите си, обаче, тази компания е разработила така наречените специализирани LPU (language processing units), които са създадени за ефективно и бързо изпълнение на големи езикови модели.
По думите на компанията Groq LPU Inference Engine е „цялостна система за ускоряване на системата за изводи, която осигурява значителна производителност, ефикасност и прецизност в прост дизайн“. Понастоящем тя работи с Llama-2 70B, широкомащабен генеративен ИИ-модел със скорост 300 токена на потребител в секунда.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!