DeepSeek срещу ChatGPT: Кой води в AI битката

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Само за няколко дни китайската компания DeepSeek се превърна от малко известен стартъп в основна тема за обсъждане в технологичната общност. Нейният чатбот се изкачи до върха на класациите на Apple App Store и Google Play, принуждавайки анализаторите от Уолстрийт и технологичните експерти да се замислят сериозно за бъдещето на американското лидерство в областта на изкуствения интелект.

От алгоритми за търговия до пробиви в областта на AI

Историята на DeеpSeek започва не като технологичен стартъп, а в света на квантовите хедж фондове. Компанията израства от High-Flyer Capital Management – китайски количествен хедж фонд, който използва алгоритми с изкуствен интелект за вземане на търговски решения.

Основателят на фонда Лианг Уенфън, ентусиаст в областта на изкуствения интелект, започва работа като студент в университета в Джъдзян, където за първи път опитва силите си в търговията. През 2015 година той става съосновател на High-Flyer. През 2019 година той стартира пълноценен хедж фонд, фокусиран върху разработването и внедряването на алгоритми с изкуствен интелект.

Повратният момент настъпва през 2023 година, когато High-Flyer създава DeepSeek като отделна изследователска лаборатория, посветена на проучването на AI инструменти извън финансовия бизнес. Лабораторията скоро се отделя в независима компания със същото име – DeepSeek.

Технически предизвикателства и иновативни решения

От самото начало DeepSeek изгражда свои собствени клъстери от центрове за данни, за да обучава своите AI модели. Въпреки това, подобно на други китайски компании в областта на изкуствения интелект, DeepSeek се сблъска с ограниченията на САЩ за износ на хардуер. За да обучи един от най-новите си AI модели, компанията беше принудена да използва чипове Nvidia H800 – по-слаба версия на H100.

Техническият екип на DeepSeek се характеризира с млад състав. Компанията агресивно набира студенти от най-добрите китайски университети. Интересно е, че DeepSeek наема и специалисти без образование в областта на компютърните науки.

Еволюция на AI моделите: От първите стъпки до глобалното разпознаване

През ноември 2023 година DeepSeek представи първия си набор от AI модели: DeepSeek Coder, DeepSeek LLM и DeepSeek Chat. Истинският пробив обаче настъпва през пролетта на следващата година с пускането на следващото поколение AI модели от фамилията DeepSeek-V2.

DeepSeek-V2: Повратната точка

DeepSeek-V2 е универсална система за анализ на текст и изображения, която демонстрира впечатляващи резултати в различни бенчмаркове за оценка на изкуствения интелект. Основният коз на модела беше неговата рентабилност. Оказа се, че експлоатацията му е значително по-евтина в сравнение с подобни решения от онова време.

Успехът на DeepSeek-V2 принуди китайските конкуренти, сред които ByteDance и Alibaba спешно да намалят цените за използване на AI моделите си и да направят някои услуги безплатни.

DeepSeek-V3: Ново ниво на производителност

Пускането на DeepSeek-V3 през декември 2024 година само подобри репутацията на компанията. Според вътрешните тестове на DeepSeek, V3 превъзхождаше както открито достъпните модели като Llama на Meta, така и „затворените“ модели, достъпни само чрез API, включително GPT-4o на OpenAI.

R1: Революция в моделите за „разсъждение“

Особено внимание заслужава AI моделът R1 на DeepSeek , пуснат през януари тази година. Този „разсъждаващ“ AI модел, според твърденията на DeepSeek, демонстрира производителност, равна на тази на o1 на OpenAI, в ключови бенчмаркове.

Начинът, по който работят разсъждаващите модели: Tе ефективно проверяват собствените си факти, което помага да се избегнат много от грешките, характерни за конвенционалните AI модели. Въпреки че такива модели работят по-бавно (обикновено със секунди или минути), те показват значително по-висока надеждност в областите на физиката, природните науки и математиката.

Ограничения и политически съображения

Въпреки техническия напредък, AI моделите на DeepSeek имат значителни ограничения. Като китайски разработки в областта на изкуствения интелект те подлежат на преглед от китайския интернет регулатор, за да се гарантира съответствие с „основните социалистически ценности“. В чатбота на DeepSeek AI моделът R1 отказва да отговаря на въпроси за протестите на площад Тянанмън или автономията на Тайван.

Пазарно въздействие и бизнес модел

До месец март DeepSeek надхвърля границата от 16,5 милиона посещения и се нарежда на второ място по популярност, въпреки че трафикът е спаднал с 25% в сравнение с февруари. Тези цифри обаче все още бледнеят в сравнение с ChatGPT, който надмина 500 милиона седмични активни потребители.

Бизнес моделът на DeepSeek остава загадка. Компанията предлага своите продукти и услуги на цени, значително по-ниски от пазарните, а много от тях предлага безплатно. В същото време DeepSeek не привлича инвестиционни средства, въпреки огромния интерес от страна на рискови капиталисти. Компанията обяснява ценовата си конкурентоспособност с пробив в ефективността, въпреки че някои експерти поставят под въпрос предоставените данни.

Реакцията на индустрията: От възхищение до забрани

Разработчиците активно използват AI моделите на DeepSeek, които, макар и да не са с напълно отворен код в традиционния смисъл на думата, са достъпни с лицензи, които позволяват търговско използване. Според главния изпълнителен директор на Hugging Face Клем Деланг разработчиците са създали повече от 500 „производни“ AI модела, базирани на R1, които общо са били изтеглени 2,5 милиона пъти.

Успехът на DeepSeek предизвика различни реакции:

Положителни:

  • Microsoft включи DeepSeek в своята услуга Azure AI Foundry;
  • Главният изпълнителен директор на Nvidia Дженсън Хуанг отбеляза „превъзходната иновация“ на DeepSeek;

Предпазливи:

  • Цената на акциите на Nvidia спадна с 18% през януари, отчасти поради успеха на DeepSeek;
  • Главният изпълнителен директор на OpenAI Сам Алтман беше принуден да реагира публично на постиженията на конкурента;

Враждебни:

  • OpenAI нарече DeepSeek „държавно субсидиран“ и „държавно контролиран“;
  • Южна Корея забрани използването на DеepSeek;
  • Щатът Ню Йорк забрани използването на DеepSeek на правителствени устройства;
  • Microsoft забрани на служителите си да използват DеepSeek поради опасения за сигурността на данните;

Глобални последици и бъдеще

Феноменът DeepSеek принуди индустрията да преосмисли ресурсите, необходими за създаването на конкурентни AI модели. Ако твърденията на компанията за изчислителна ефективност са верни, това може да промени драстично икономиката на разработването на AI.

Перспективи за развитие

Бъдещето на DeepSeеk остава несигурно. Несъмнено ще бъдат пуснати подобрени AI модели, но правителството на САЩ проявява все по-голяма предпазливост към това, което възприема като вредно чуждестранно влияние.

През март The Wall Street Journal съобщи, че САЩ вероятно ще забранят DeepSеek на правителствените устройства. Заместник-председателят и президент на Microsoft Брад Смит заяви пред Сената, че служителите на Microsoft нямат право да използват DeеpSeek поради опасения за сигурността на данните и пропагандата.

Заключение

Историята на DeеpSeek показва как иновативните подходи към разработването на AI могат бързо да променят баланса на силите на световния пазар. Независимо от политическите и икономическите противоречия около компанията, нейните технически постижения вече принудиха индустрията да преосмисли установените представи за разработването и внедряването на AI.

Китайската компания доказа, че революционни пробиви в областта на изкуствения интелект могат да се случат не само в Силициевата долина, a навсякъде по света, където има талантливи изследователи и иновативни подходи за решаване на технологични проблеми.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини