Според прогнозата на Gartner, до 2030 г. инференса на LLM от трилион параметъра ще струва на доставчиците на AI-услуги над 90% по-евтино, отколкото през 2025 г. Това обаче не означава всеобщ достъп до съвременните изчисления.
Gartner за изследванията оцени всеки...
Южнокорейският стартъп HyperAccel, според EETimes, се готви да пусне Bertha 500 — специализиран чип, предназначен за ИИ-инференс. Благодарение на уникалната си архитектура, се твърди, че чипът генерира пет пъти повече токени в секунда от решенията, базирани на графични процесори,...