След месеци на слухове и спекулации вчера OpenAI представи GPT-4: най-новият от серията езикови модели за изкуствен интелект, които захранват приложения като ChatGPT и новия Bing.
Компанията твърди, че моделът е „по-креативен и сътрудничещ от всякога“ и „може да решава трудни проблеми с по-голяма точност“. Той може да анализира както текст, така и изображения, но може да отговаря само чрез текст. OpenAI също така предупреждава, че системите запазват много от проблемите от по-ранните езикови модели, включително склонност към „халюциниране“ (измисляне на информация) и способност за генериране на текстове, съдържащи насилие или обиди.
OpenAI заявява, че вече си партнира с редица компании за интегриране на GPT-4 в техните продукти, включително Duolingo, Stripe и Khan Academy. Новият модел е достъпен за широката общественост чрез ChatGPT Plus, чрез месечен абонамент на стойност 20 долара, и захранва чатбота Bing на Microsoft. Той ще бъде достъпен и като API за разработчици, които ще могат да използват.
В публикация в изследователския блог OpenAI заяви, че разликата между GPT-4 и неговия предшественик GPT-3.5 е „едва доловима“ в обикновен разговор (GPT-3.5 е моделът, който захранва ChatGPT в момента). Главният изпълнителен директор на OpenAI, Сам Алтман написа в Twitter, че GPT-4 „все още има недостатъци“, но също така „изглежда по-впечатляващ при първа употреба, отколкото след като прекарате повече време с него“.
През изминалата година се появиха множество спекулации относно GPT-4 и неговите възможности, като мнозина предполагаха, че той ще бъде огромен скок в сравнение с предишните системи, въпреки това, ако се съди по съобщението на OpenAI, подобрението е по-скоро системно, както компанията предупреди по-рано.
Миналата седмица слуховете се разпространиха още повече, след като в интервю за германската преса изпълнителен директор на Microsoft даде да се разбере, че системата ще бъде пусната на пазара тази седмица. Изпълнителният директор също така предположи, че системата ще бъде мултимодална – т.е. ще може да генерира не само текст, но и други носители, например изображения. Много ИИ изследователи смятат, че мултимодалните системи, които интегрират текст, аудио и видео предлагат най-добрия път към изграждането на по-способни системи за ИИ.
GPT-4 наистина е мултимодален, но в по-малък мащаб отколкото някои прогнозираха. OpenAI твърди, че системата може да приема текстови и графични въпроси и да излъчва текстови резултати. Компанията твърди, че способността на модела да анализира едновременно текст и изображение му позволява да интерпретира по-сложни входни данни. В примерите по-долу можете да видите как системата обяснява тези необичайни изображения:



Пътят до GPT-4 беше дълъг, като OpenAI и изобщо езиковите модели набираха скорост бавно в продължение на няколко години, преди да навлязат в масова употреба през последните месеци.
Оригиналният научен труд, в който се описва GPT е публикуван през 2018 година, GPT-2 е обявен през 2019 година, а GPT-3 – през 2020 година. Тези модели се обучават върху огромни масиви от текстови данни, голяма част от които са събрани от интернет и в тях се търсят статистически модели. След това тези модели се използват, за да се предскаже коя дума следва друга. Механизмът е сравнително прост за описване, но крайният резултат са гъвкави системи, които могат да генерират, обобщават и преформулират писмени текстове, както и да изпълняват други текстови задачи като превод или генериране на код.
Първоначално OpenAI забави пускането на своите GPT модели поради опасения, че те ще бъдат използвани за злонамерени цели, като например генериране на спам и дезинформация, но в края на 2022 година компанията пусна ChatGPT – разговорен чатбот, базиран на езиковия модел GPT-3.5, до който има достъп всеки. Пускането на ChatGPT предизвика лудост в света на технологиите, като скоро Microsoft го последва със собствен чатбот с изкуствен интелект, част от търсачката Bing, а Google се опита да се включи в състезанието с Bard – друг чатбот с изкуствен интелект.
Както беше предвидено, по-широката достъпност на тези езикови модели с изкуствен интелект създаде проблеми и предизвикателства. Образователната система все още се адаптира към съществуването на софтуер, който пише прилични есета. Сайтове като Stack Overflow и списанието за научна фантастика Clarkesworld трябваше да прекратят подаването на документи поради притока на съдържание, генерирано от ИИ, а първите употреби на инструменти за писане с ИИ в журналистиката бяха в най-добрия случай рокади. Но някои експерти твърдят, че вредните последици все пак са били по-малки от очакваното.
При обявяването на GPT-4, OpenAI подчерта, че системата е преминала през шестмесечно обучение за безопасност и че при вътрешните тестове е „с 82% по-малка вероятността да отговори на заявки за забранено съдържание и с 40% по-голяма вероятност да даде фактологични отговори в сравнение с GPT-3.5“.
Това обаче не означава, че системата не прави грешки или не показва неподходящо съдържание. Например Microsoft разкри, че чатботът на Bing през цялото време е бил захранван от GPT-4 и много потребители са успели да нарушат защитите на Bing по всевъзможни креативни начини, карайки бота да дава опасни съвети, да заплашва потребителите и да си измисля информация. Освен това, GPT-4 все още не разполага със знания за събитията, които са се случили след прекъсването на по-голямата част от неговите данни през септември 2021 година.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!