Американският стартъп Cerebras Systems представи гигантския процесор WSE-3 за приложения, свързани с машинно обучение и други ресурсоемки задачи. Компанията твърди, че е процесорът е увеличил два пъти производителността си за ват консумирана енергия в сравнение с предшественика си.
Площта на новия процесор е 46 225 mm2. Той е произведен по 5 nm процес на TSMC, съдържа 4 трилиона транзистора, 900 000 ядра и е комбиниран с 44 GB вградена SRAM памет. Твърди се, че производителността му при FP16 операции е 125 Pflops.
В сравнение с ускорителя H100 на Nvidia, базираната на WSE-3 платформа Cerebras CS-3 е физически 57 пъти по-голяма и около 62 пъти по-бърза във FP16 операциите. Но като се имат предвид размерът и консумацията на енергия на Cerebras CS-3, по-справедливо е да се сравни с платформата Nvidia DGX с 16 ускорителя H100. Дори и в този случай обаче CS-3 е около 4 пъти по-бърз от конкурента си, ако говорим за FP16 операции.

Едно от основните предимства на системите Cerebras е тяхната честотна лента. С 44 GB SRAM във всеки WSE-3, най-новата система Cerebras CS-3 има широчина на честотната лента от 21 байта в секунда. За сравнение, Nvidia H100 с HBM3 памет има пропускателна способност от 3,9 байта в секунда. Това обаче не означава, че системите Cerebras са по-бързи във всички сценарии на използване от конкурентните решения. Тяхната производителност зависи от фактора „разредени“ операции.
Nvidia постига двойно по-голям брой операции с плаваща запетая от своите решения, използвайки „разредени“ операции. На свой ред Cerebras твърди, че е постигнала подобрение до около 8 пъти. Това означава, че новата система Cerebras CS-3 ще бъде малко по-бавна при по-плътни FP16 операции от двойка сървъри Nvidia DGX H100 при същата консумация на енергия и площ. Тя ще осигури около 15 Pflops производителност спрямо 15,8 Pflops на Nvidia (16 ускорителя H100 осигуряват 986 Tflops производителност).

В допълнение към обявяването на новия процесор, Cerebras обяви, че си сътрудничи с Qualcomm за създаване на оптимизирани модели за ИИ-ускорителите с архитектура Arm на Qualcomm.
Двете компании намекват за потенциално сътрудничество още от ноември миналата година. Тогава Qualcomm представи собствения си ИИ-ускорител Cloud AI100 Ultra PCIe формат. Той съдържа 64 ИИ-ядра, 128 GB LPDDR4X памет с пропускателна способност 548 GB/s и осигурява производителност при INT8 операции от 870 TOPS. Той има TDP от 150 W.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!