NVIDIA анонсира новото семейство ИИ модели Llama Nemotron с разширени възможности за разсъждение. Базирани на моделите с отворен код Llama от Meta Platforms, моделите на NVIDIA са предназначени да предоставят на разработчиците основа за създаване на усъвършенствани ИИ агенти, които могат да работят самостоятелно или с минимален надзор в състава от свързани екипи, за да решават сложни проблеми.
„Агентите са автономни софтуерни системи, създадени да разсъждават, планират, действат и критикуват работата си“, заяви Кари Бриски, вицепрезидент по управление на софтуерните продукти за генеративен изкуствен интелект в NVIDIA, на брифинг за пресата, пише VentureBeat. „Подобно на хората, агентите трябва да разбират контекста, за да разделят сложните заявки, да разбират намеренията на потребителите и да се адаптират в реално време“, добави тя. Като е взела Llama за основа, NVIDIA е оптимизирала модела по отношение на изчислителните изисквания, като същевременно е запазила точността на отговорите, каза Бриски.
NVIDIA заяви, че е усъвършенствала новото семейство разсъждаващи модели по време на предварителното обучение, за да подобри многостъпковите математически изчисления, кодирането, разсъжденията и вземането на сложни решения. Това е подобрило точността на отговорите на модела с до 20% спрямо базовия модел и е увеличило скоростта на умозаключенията пет пъти в сравнение с другите водещи разсъждаващи модели с отворен код. Подобрената производителност на заключенията означава, че моделите могат да се справят с по-сложни задачи за разсъждение, имат подобрени възможности за вземане на решения и намаляват оперативните разходи на предприятията, обясняват от компанията.

Моделите на Llama Nemotron са налични във версии Nano, Super и Ultra и иползват процесорите NVIDIA NIM. Те са оптимизирани за различни сценарии на внедряване: Nano за персонални компютри и периферни устройства, като се поддържа висока точност на разсъжденията, Super за оптимална производителност и точност в среди с един ускорител и Ultra за максимална „точност на агента“ в среди с много ускорители в дейта центровете.
Според NVIDIA обширното предварително обучение е проведено с помощта на услугата NVIDIA DGX Cloud, като са използвани висококачествени курирани синтетични данни, генерирани от NVIDIA Nemotron и други модели с отворен код, както и допълнителни курирани набори от данни, създадени съвместно от NVIDIA. Обучението е включвало 360 000 часа умозаключения с помощта на ускорителите H100 и 45 000 часа човешка анотация, за да се подобрят възможностите за разсъждение. Според компанията инструментите, наборите от данни и техниките за оптимизация, използвани за разработване на моделите, ще бъдат свободно достъпни, което дава на предприятията гъвкавостта да създават свои собствени разсъждаващи модели.

Една от ключовите характеристики на NVIDIA Llama Nemotron е възможността за включване, изключване и регулиране на нивото на разсъждение. Това е нова възможност на пазара на изкуствен интелект, твърдят от компанията. Anthropic Claude 3.7 има донякъде подобна функционалност, въпреки че е затворен патентован модел. Сред моделите с отворен код IBM Granite 3.2 също има превключвател на разсъжденията, който IBM нарича „условно разсъждение“.
Това, което прави хибридното или условното разсъждаване специално, е, че то позволява на системите да елиминират изчислително скъпите стъпки на разсъждаване при по-простите заявки.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!