Alibaba, ByteDance и Kuaishou представиха редица нови ИИ-модели – от роботи до кинематографично видео

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Докато американският пазар на изкуствен интелект миналата седмица беше зает с изучаване на влиянието на инструментите от Anthropic и Altruist върху програмирането и финансовите услуги, китайските технологични гиганти пуснаха ИИ-модели, които демонстрираха подобрения в производителността в областта на роботиката и генерирането на видео. Alibaba, ByteDance (собственикът на TikTok) и платформата за кратки видеоклипове Kuaishou представиха нови алгоритми, потвърждаващи, че китайските разработчици са в крак с американските си колеги.

Анонсът на новите алгоритми на китайските технологични гиганти идва на фона на неотдавнашно изявление на Демис Хасабис, ръководител на отдела за изкуствен интелект в Google DeepMind, че китайските AI-модели изостават само с няколко месеца от западните си конкуренти. Инструментите, представени миналата седмица, обаче биха могли да се считат за директни конкуренти на ИИ-моделите за генериране на видео, като OpenAI Sora, както и на роботизираните модели от Nvidia и Google.

Изследователското подразделение на Alibaba, DAMO, обяви RynnBrain —- модел с изкуствен интелект, предназначен да помогне на роботите да разбират физическия свят около тях и да идентифицират обекти. В демонстрационно видео Alibaba показа робот с нокти вместо ръце, който бере портокали и ги поставя в кошница. Роботът беше показан и как вади мляко от хладилник.

AI-моделите изискват обширно обучение, за да се научат да идентифицират успешно различни предмети и да взаимодействат с тях в ежедневието. Това означава, че една проста човешка задача, като брането на плодове, е много по-сложна за роботиката. С пускането на RynnBrain, Alibaba ще започне да се конкурира с компании като Nvidia и Google, които разработват свои собствени ИИ-модели за роботиката.

Една от ключовите иновации [на ИИ-модела] е вградената му осведоменост за времето и пространството. Вместо просто да реагира на непосредствени сигнали, роботът може да запомни кога и къде са се случили събитията, да проследява напредъка на задачите и да продължи да действа на множество етапи. Това го прави по-стабилен и последователен в сложни реални среди“ — казва Адина Якефу, изследовател в Hugging Face. Тя добави още, че „по-голямата цел“ на Alibaba е да „създаде базов интелигентен слой за въплътени системи “ .

Миналата седмица ByteDance представи Seedance 2.0 —- ИИ-модел за генериране на видео, който може да създава реалистични видеоклипове въз основа на прости текстови описания. Алгоритъмът може да работи и с други видеоклипове и изображения. Демо видеоклиповете, създадени със Seedance 2.0, изглеждат доста реалистично.

Alibaba, ByteDance и Kuaishou представиха редица нови ИИ-модели – от роботи до кинематографично видео

Адина Якефу потвърди, че AI-моделът Seedance 2.0 е демонстрирал значителни подобрения спрямо предишните версии по отношение на „управляемост, скорост и ефективност“. „Seedance 2.0 в момента е един от най-балансираните модели за генериране на видео, които съм тествала. Изненада ме с предоставянето на задоволителни резултати от първия опит, дори с проста заявка. Визуалните елементи, звукът и работата с камерата са интегрирани по такъв начин, че резултатът да изглежда по-скоро изпипан, отколкото експериментален“ —- добави Якефу.

Въпреки че потребителите хвалят алгоритъма, е известно, че Seedance 2.0 е срещнал проблеми. Китайските медии съобщиха, че разработчиците временно са блокирали функцията, която генерира глас на човек въз основа на качена снимка. Това се случи, след като местен блогър подчерта проблема с генерирането на глас въз основа на снимка без съгласието на човека от снимката. Представители на ByteDance все още не са коментирали проблема.

Друга нова разработка е AI-моделът Kling 3.0 на Kuaishou, предназначен за генериране на видео и конкурент на алгоритъма на ByteDance. В съобщението се посочва, че Kling 3.0 „съдържа значителни подобрения в консистентността, фотореалистичните резултати, увеличената продължителност на видеото до 15 секунди и вграденото генериране на звук на множество езици, диалекти и акценти“.

В момента алгоритъмът Kling 3.0 е достъпен само за платените абонати, но Kuaishou обещава скоро да го отвори за по-широката аудитория. Успехът на компанията с AI-моделите на Kling е довел до покачване на цената на акциите на Kuaishou с повече от 50% през последната година.

Заслужава да се споменат и няколко други важни издания. Компанията Zhipu AI, която работи в Хонконг под името Knowledge Atlas Technology, представи алгоритъма GLM-5 — отворен езиков модел с разширени възможности в областта на програмирането и създаването на AI-агенти. Компанията твърди, че най-новата версия на нейния AI-модел се доближава по възможности в профилните бенчмаркове до Anthropic Claude Opus 4.5 и превъзхожда Google Gemini 3 Pro в някои тестове. Това издание допринесе за значителното увеличение на цената на акциите на Zhipu AI.

Цената на акциите на MiniMax също скочи в края на седмицата, след като компанията пусна актуализирана версия на своя ИИ-модел с отворен код M2.5, с подобрени инструменти за AI-агенти. Този алгоритъм може да се използва за ефективно автоматизиране на различни задачи.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини