По-големите модели могат да извършат по-голямо разнообразие от действия, но намалената дълбочина на по-малките модели ги прави много привлекателни инструменти.
Големите езикови модели работят добре, защото са наистина огромни. Най-новите модели на OpenAI, Meta и DeepSeek използват стотици милиарди параметри...
Много малките езикови модели (SLM) могат да надминат водещите големи езикови модели (LLM) в задачите за разсъждение, според ново проучване на Shanghai Artificial Intelligence Lab. Авторите показват, че с правилните инструменти и техники за мащабиране по време на тестването,...
В ново проучване от Hugging Face, изследователите демонстрираха как малките SLM езикови модели могат да бъдат настроени, за да превъзхождат много по-големите модели. Техните резултати показват, че моделът Llama 3 с параметри 3B може да надмине версията със 70B...