Ефектът DeepSeek: Как Китай разби кода на успеха на американския изкуствен интелект

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Китайските компании активно разработват големи езикови модели (LLM), като се конкурират със западните лидери въпреки санкциите и ограниченията за достъп до мощни ИИ-чипове на Nvidia. Неотдавнашното пускане на модела DeepSeek R1 беше значимо събитие за индустрията, което демонстрира способността на Китай да създава мощни ИИ-решения на значително по-ниска цена.

Разработчиците на DeepSeek твърдят, че обучението на техния модел е струвало само 5,6 млн. долара, което е в пъти по-малко от сумите, изразходвани за разработката на ИИ-моделите на OpenAI, Google и Anthropic. Макар, че някои експерти оспорват тази сума, твърдейки, че реалните разходи са по-високи, ефектът от пускането на модела R1 беше зашеметяващ – водещите западни компании за изкуствен интелект загубиха милиарди долари от капитализацията си.

Но DeepSeek не е единственият играч на китайския пазар и успехът на R1 даде началото на поредица от съобщения от други местни разработчици. Alibaba, ByteDance, Baidu и Tencent представиха актуализации на своите ИИ-модели, като заявиха превъзходство по редица ключови показатели.

Alibaba: Qwen2.5

Alibaba представи Qwen2.5-VL и Qwen2.5-Max, за които компанията твърди, че превъзхождат DeepSeek V3 в тестовете Arena-Hard, LiveBench, LiveCodeBench и GPQA-Diamond. Qwen2.5-VL има подобрени възможности за разпознаване на изображения, интелектуална собственост и анализ на сложни графики. Интересна особеност на Qwen2.5-VL е интегрирането на функции, базирани на агенти, които позволяват директно взаимодействие с компютри и смартфони.

ByteDance: Doubao-1.5-pro и нов подход към обучението

ByteDance, собственик на TikTok пусна на пазара Doubao-1.5-pro, който демонстрира успехи в областта на математиката и програмирането. Компанията твърди, че моделът превъзхожда OpenAI o1 в теста AIME, който оценява способността на моделите да извършват многоетапни математически разсъждения.

Doubao-1.5-pro използва архитектура Mixture of Experts (MoE) за оптимизиране на производителността. Този подход позволява само част от параметрите да бъдат ангажирани всеки път, когато се осъществява достъп до тях, което прави работата на модела много по-икономична. ByteDance твърди, че нейният ИИ-модел е 5 пъти по-евтин от DeepSeek и 200 пъти по-евтин от OpenAI o1, което го прави един от най-ефективните по отношение на съотношението цена-енергия.

Tencent: Най-големият отворен модел и генериране на 3D обекти

През ноември Tencent представи три нови ИИ-модела от серията Hunyuan , включително Hunyuan-MoE-A52B – най-големият отворен MoE модел с 389 милиарда параметри. Компанията твърди, че той превъзхожда DeepSeek и Meta LLama 3.1-405B в разбирането на естествен език, логическото разсъждение и решаването на въпроси, базирани на знания.

Неотдавна Tencent обяви Hunyuan3D 2.0 – актуализирана система за генериране на 3D, която позволява създаването на 3D обекти от 2D изображения. Компанията заяви, че нейният модел превъзхожда предишните решения по отношение на геометричната точност, качеството на текстурите и съответствието с оригинала.

Baidu: 300 милиона потребители и планове за растеж

Baidu, един от първите китайски разработчици на LLM представи Ernie 4.0 през 2024 година, който оглави класацията на китайските модели според университета Цинхуа. Въпреки това експертите заявиха, че по критерии като програмиране и логическо мислене моделите OpenAI и Anthropic остават лидери.

През юни Baidu пусна Ernie 4.0 Turbo – версия с по-бързо време за реакция и подобрени възможности за анализ. Компанията също така продължава да разработва своята платформа PaddlePaddle 3.0, но все още не е представила нови LLM през 2024 година. Въпреки това компанията вече има над 300 млн. потребители, което я прави една от най-популярните ИИ-платформи в Китай.

Западът вече не е лидер?

Доскоро се смяташе, че китайските компании изостават в разработването на ИИ поради ограниченията за внос на усъвършенстваните процесори Nvidia, необходими за обучението по LLM. Новите подходи, като например MoE обаче дават възможност да се оптимизира процесът на обучение, като се намаляват разходите, без да се влошава значително качеството.

Фактът, че китайски стартъп е успял да създаде мощен ИИ-модел само за 5,6 млн. долара поставя под въпрос необходимостта от милиардни инвестиции, направени от западните компании. Въпросът сега е не дали Китай ще успее да настигне OpenAI, а колко бързо ще успее да изпревари западните си конкуренти.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

11 Коментара
стари
нови оценка

Нови ревюта

Подобни новини