Залезът на човешкото господство? ИИ ни превъзхожда в почти всички тестове за интелигентност

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Институтът за изкуствен интелект към Станфордския университет (HAI) публикува седмия си годишен доклад AI Index, който отразява бързото развитие на технологията и нарастващото ѝ въздействие върху ежедневието ни. В това издание има повече информация, отколкото в предишните, тъй като индустрията се развива с огромни темпове.

Докладът обхваща широк спектър от теми – от сектори, които активно внедряват ИИ, до държави, загрижени за загубата на работни места.

Една от най-забележителните констатации обаче е намаляването на разликата между способността на човека и машината да решават сложни проблеми.

Например, към 2015 година ИИ вече е надминал хората в класификацията на изображения. След това, през 2017-а той ни е изпреварил в разбирането на основни текстове, през 2020-а – във визуалното мислене. А през 2021-а – в способността да прави логически заключения въз основа на естествен език. Напредъкът в тази област е толкова бърз, че много сравнителни показатели вече са загубили своята актуалност. Изследователите бързат да разработят нови, по-сложни тестове, за да проверят дали има някакви разлики между човешкия и изкуствения интелект и в какво се изразяват те.

Залезът на човешкото господство? ИИ ни превъзхожда в почти всички тестове за интелигентност
Техническа производителност на ИИ спрямо човешката производителност през годините

На графиката по-горе линиите с различни цветове показват нивото на способностите на ИИ в определени области. Пунктираната линия е средното човешко представяне. Данните са получени с помощта на стари, вероятно неактуални бенчмаркове, но общата тенденция е изключително очевидна.

Траекториите на развитие на ИИ изумяват експертите, особено почти вертикалните линии, отразяващи резултатите от най-новите тестове. Важно е обаче да се помни, че машините са като виртуални бебета, които едва започват своето пътешествие.

През 2023 година ИИ все още изпитва затруднения със сложни когнитивни задачи като решаване на сложни уравнения и визуално мислене. Терминът „трудност“ обаче не е съвсем подходящ тук – всъщност ИИ се представя впечатляващо.

През последните две години се наблюдава голям скок в решаването на математически задачи. Ако през 2021 година алгоритмите можеха да се справят само с 6,9 % от набора MATH от 12 500 олимпийски примера, то през 2023 година ИИ-моделът GPT-4 реши 84,3 % от тях. За сравнение, при хората този показател е бил 90 %.

Визуалната обща аргументация (VCR) оценява способността на ИИ да използва здрав разум във визуален контекст, за да прави логически заключения. Например, виждайки снимка на котка върху маса, ИИ с VCR би трябвало да предположи, че котката може да скочи от масата или че масата е достатъчно здрава, за да издържи теглото ѝ. Между 2022 и 2023 година резултатът на VCR се е увеличил със 7,93% до 81,6 от 100 точки, в сравнение с 85 точки за хората. Преди 5 години беше трудно да си представим, че компютър ще може да разбере контекста на едно изображение на такова ниво.

В наши дни изкуственият интелект се използва широко за създаване на текстове в различни стилове и области. Въпреки това големите езикови модели (LLM) все още са склонни към „халюцинации“ – тенденцията да представят измислена или погрешна информация.

Миналата година проблемът привлече широко обществено внимание, след като американския адвокат Стивън Шварц включи препратки към несъществуващи закони в съдебни документи, без да провери отговорите на ChatGPT. Съдията бързо разпозна грешките и глоби Шварц с 5000 долара.

В доклада се оценява и способността за генериране на изображения от текстови сигнали с помощта на еталона HEIM. Той отчита 12 ключови параметъра, важни за практическото приложение на генерираните материали. Според резултатите от партньорската проверка, нито един модел не е показал абсолютно превъзходство по всички критерии. DALL-E 2 на OpenAI показа най-добри резултати по отношение на съвпадението с входната текстова заявка. Dreamlike Photoreal, задвижван от Stable Diffusion получи най-високи оценки за качеството, естетиката и оригиналността на създадените изображения.

Въпреки, че постиженията на ИИ през миналата година са изумителни, те бледнеят в сравнение с още по-впечатляващите разработки през тази година.

През тази година светът стана свидетел на пускането на потенциално революционни разработки като Suno, Sora, Google Genie, Claude 3, Channel 1 и Devin. Всеки от тези продукти има потенциала да промени из основи цели индустрии. Най-голям интерес обаче предизвиква мистериозният GPT-5. Това е ИИ-модел с толкова широки възможности и мащаб, че ще може да засенчи и обедини всички конкуренти.

Бързото развитие на ИИ през 2023 година, отразено в доклада показва, че той ще се развива все по-бързо, намалявайки разликата с човешките възможности. Следващото издание на AI Index със сигурност ще бъде още по-проницателно и впечатляващо.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

3 Коментара
стари
нови оценка

Нови ревюта

Подобни новини