Китайската лаборатория за изкуствен интелект DeepSeek разкри версия с отворен код на своя модел за разсъждения AI R1, за който разработчиците казват, че превъзхожда AI модела o1 на OpenAI в някои бенчмаркове по редица ключови показатели.
Според TechCrunch, моделът R1 превъзхожда OpenAI o1 в бенчмаркове като AIME, MATH-500 и SWE-bench Verified. Тези тестове обхващат различни области, включително и математически задачи, програмиране и цялостно представяне на модела. AIME оценява производителността на моделите, използвайки други AI-модели. MATH-500 е набор от математически задачи, а SWE-bench Verified е фокусиран върху програмирането.
Особеност на R1 е способността му да се самотества, което помага за елиминирането на грешките, характерни за други модели. Този подход обаче отнема повече време, за да получите отговор — от няколко секунди до няколко минути. Такива модели се считат за по-надеждни в сложните области като математика, физика и различни науки.
DeepSeek казва, че R1 съдържа 671 милиарда параметри, което го прави един от най-големите модели в света. За удобство на потребителите, компанията пусна и опростени версии на R1 с обем на параметрите от 1,5 до 70 милиарда. В същото време най-компактната версия може да работи дори на обикновен лаптоп, докато пълната версия изисква по-мощно оборудване. R1 се предлага чрез API на компанията на цена, за която се твърди, че е 90-95% по-ниска от тази на OpenAI o1.
Отбелязва се, че R1 също има някои недостатъци. Тъй като моделът е разработен в Китай, той подлежи на задължителен преглед от регулаторите за съответствие с основните социалистически ценности. Например R1 отказва да отговаря на въпроси относно събитията на площад Тянанмън или независимостта на Тайван, което е характерно за много китайски ИИ-модели, които избягват обсъждането на политически теми, които са чувствителни за Поднебесната империя.
DeepSeek стана първата китайска лаборатория, която влезе в истинска конкуренция с OpenAI o1, представяйки предварителна версия на R1 през ноември. Въпреки това беше последван от други играчи, включително Кими от Alibaba и Moonshot AI. Според Дийн Бол, изследовател на изкуствения интелект в университета Джордж Мейсън, това показва, че китайските AI-компании продължават да бъдат „бързи последователи“ в технологичната надпревара:
„Успехът на опростените версии на DeepSeek […] показва, че мощните модели на разсъждения ще стават все по-достъпни и ще могат да работят дори на локален хардуер“ — отбеляза Бол в публикацията си на платформата X.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!