Китай е разработил ИИ модела DeepSeek-R1, който може да разсъждава върху поставените задачи и да проверява заключенията си. Технологията бе представена от изследователската лаборатория DeepSeek, финансирана от хедж фонда High-Flyer Capital Management. Създателите твърдят, че DeepSeek-R1 е в състояние да се конкурира с модела o1 на OpenAI въз основа на два популярни критерия за оценка – AIME и MATH.
DeepSeek-R1 прилага уникален подход към обработката на заявките: вместо да предоставя незабавен отговор, моделът разделя проблема на етапи и го анализира стъпка по стъпка. Решаването на някои сложни заявки може да отнеме на алгоритъма няколко десетки секунди. Този метод помага да се сведат до минимум грешките, характерни за другите ИИ модели. Въпреки това потребителите отбелязват, че системата изпитва затруднения с някои елементарни логически игри, като например играта „кръстчета-нулички“ (tic-tac-toe).
DeepSeek-R1 вече предизвика полемика сред експертите заради уязвимостта си към заобикаляне на механизмите за сигурност. В интернет се появиха примери за потребители, които получават инструкции от ИИ за създаване на незаконни вещества. Освен това алгоритъмът отказва да обсъжда теми, които се регулират от китайските власти, като например събитията на площад „Тянанмън“ или евентуален конфликт с Тайван. Тези ограничения се дължат на изискването да се спазват „основните социалистически ценности“, определени от държавния регулатор.
Интересът към системите за „машинно разсъждение“ нарасна на фона на забавянето на напредъка в разработването на модели, основани на единствено увеличаващите се количества данни и изчислителна мощ. Разработчиците на DeepSeek-R1 използват подход, наречен „test-time compute“, който позволява на модела да използва допълнителни ресурси за анализ на задачите. Тази технология беше изтъкната от главния изпълнителен директор на Microsoft Сатя Надела, който заяви появата на нов „модел на мащабиране“ за изкуствения интелект.

DeepSeek планира да превърне DeepSeek-R1 в проект с отворен код, като предостави на разработчиците кода и приложните програмни интерфейси. Лабораторията вече стана известна със своя модел DeepSeek-V2, който оказа влияние върху пазара, компании като ByteDance, Baidu и Alibaba бяха принудени да намалят цените си или дори да направят услугите си безплатни.
High-Flyer Capital Management активно подкрепя проекта и използва 10 000 графични процесора Nvidia A100 за обучение на моделите. Сървърният клъстер на компанията струва около 138 млн. долара. Ръководителят на компанията Лианг Уенфън заяви, че крайната ѝ цел е да създаде „свръхинтелигентност“, която да надмине човешкия интелект.
Разработването на изкуствен интелект с мисловна функция отразява общата тенденция за намиране на нови подходи за неговото развитие. Традиционните методи за усъвършенстване на моделите, основани на увеличаване на изчислителната мощ и обема на данните, се сблъскаха с ограничения през последните години. Това принуждава изследователите да търсят иновативни начини, като например използване на допълнителни ресурси за изпълнение на задачите в реално време (test-time compute).
Китай заема специално място в развитието на ИИ, тъй като активно инвестира в нови технологии. Според наскоро публикуваната класация на световните екосистеми за ИИ тази държава е на второ място в ИИ индустрията и се готви да заеме водеща позиция. Тайната на успеха на Китай е в патентите, безпрецедентния размер на инвестициите и ясната национална стратегия.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!