NVIDIA представи ИИ-ускорителите H200 и Quad GH200

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

NVIDIA представи новите ИИ-ускорители H200, базирани на същата архитектура Hopper като предшествениците си H100, представени преди повече от година и половина. Според компанията новият H200 е първият в света ИИ-ускорител, който използва HMB3e памет. Дали ще измести H100, или ще остане междинно звено в еволюцията на решенията на NVIDIA само времето ще покаже – H200 ще бъде наличен през второто тримесечие на следващата година, но през 2024-та се очаква и ново поколение ускорители – B100, които ще бъдат по-мощни и от H100 и от H200.

H200 разполага със 141 GB HBM3e памет с обща пропускателна способност (ОПС) от 4,8 TB/s. За сравнение H100 има 80 GB HBM3 памет и ОПС от 3,35 TB/s. Хибридните ускорители GH200 ще получат до 480 GB LPDDR5x памет (512 GB/s) и 144 GB HBM3e памет (4,9 TB/s). Актуализираната версия на GH200 ще стане масово достъпна след пускането на H200, но междувременно NVIDIA ще доставя оригиналния 96 GB вариант с HBM3 памет. Напомняме, че предстоящият конкурентен модел AMD Instinct MI300X ще получи 192GB HBM3 памет с ОПС от 5,2 TB/s.

Към този момент NVIDIA не е разкрила пълните спецификации на H200, но изглежда, че изчислителната част на H200 остава същата или почти същата като тази на H100. NVIDIA цитира FP8 производителността на HGX-платформата с 8 ускорителя (има и вариант с 4), която е 32 Pflops. Това означава 4 Pflops за всеки H200 – точно толкова, колкото е предлагал и H100. Въпреки това има полза от по-бързата и по-обемна памет – при задачите за изводи може да се получи увеличение от 1,6-1,9 пъти.

NVIDIA представи ИИ-ускорителите H200 и Quad GH200

Платките HGX H200 са напълно съвместими с платформите HGX H100, които вече са на пазара, както механично, така и по отношение на захранването и разсейването на топлината. Това ще позволи на партньори като ASRock Rack, ASUS, Dell, Eviden, GIGABYTE, HPE, Lenovo, QCT, Supermicro, Wistron и Wiwynn много бързо да актуализират своите предложения. H200 ще се предлага и в облак. AWS, Google Cloud Platform, Oracle Cloud, CoreWeave, Lambda и Vultr ще бъдат първите, които ще ги получат.

NVIDIA представи ИИ-ускорителите H200 и Quad GH200

В същото време NVIDIA представи основния „градивен елемент“ за суперкомпютрите на близкото бъдеще – платката Quad GH200 с 4 чипа GH200, където всички ускорители са свързани помежду си чрез NVLink по схемата „всеки с всеки“. Като цяло платката носи повече от 2 TB памет, 288 Arm ядра и предлага FP8 производителност от 16 Pflops. Quad GH200 е в основата на възлите HPE Cray EX254n и Eviden Bull Sequana XH3000. Според оценките на NVIDIA до края на 2024 година общата производителност на системите за изкуствен интелект, базирани на GH200 ще достигне 200 Eflops.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини