Тестове потвърдиха, че DeepSeek генерира два пъти повече лош код, когато темата е свързана с враговете на Китай. Когато темите на заявките са „враждебни“, процентът на грешки се увеличава до над 42%.
Американската компания за сигурност CrowdStrike проведе проучване, използвайки заявки за ИДИЛ, Фалун Гонг, Тибет и Тайван. Интересното е било дали споменаването на „враждебни теми“ би влошило кода. Например, при нормални условия DeepSeek показва около 22,8% грешки при създаването на код за индустриални системи за управление. Но когато същите заявки са свързани с ИДИЛ, процентът скача рязко до 42,1%.
Изследователите разделили заявките на групи и установили, че кодът, свързан с ИДИЛ, съдържал почти два пъти повече грешки, а в 61% от случаите DeepSeek изобщо отказва да го генерира. По темата за Фалун Гонг процентът на отхвърляне е 45%, а в сценарии, свързани с Тибет и Тайван, качеството на кода спада значително, макар и по-малко драстично.
CrowdStrike подчертава, че най-поразителното не е самият процент на отхвърляне, а разликата в процентите на грешките. Понякога, вместо да издаде категорична забрана, DeepSeek генерира работещ код, който в крайна сметка съдържа два пъти повече грешки. Има няколко теории защо това се случва:
- Скрит саботаж. На пръв поглед кодът може да изглежда „работещ“ и полезен, но всъщност той съдържа критични недостатъци. Тези недостатъци отварят допълнителни възможности за атака и го правят по-малко сигурен.
- Разликата е в тренировъчните данни. DeepSeek се представя по-добре по теми с много висококачествени примери — например американските пазари. Но за Тибет или Фалун Гонг има малко данни, така че изкуственият интелект е по-склонен да прави грешки.
- Търговска мотивация. DeepSeek може да инвестира повече ресурси в работа с клиенти в САЩ, за да спечели пазарен дял.
- Автоматично обучение по „червени линии“. Изкуственият интелект може автономно да се „учи“, за да избягва теми, които смята за враждебни, тъй като такива сигнали присъстват в данните му за обучение, дори без изрична забрана.
Изследователите отбелязват, че през август DeepSeek е извършил обучението на моделите от Nvidia към оборудване на Huawei по искане на Пекин. Това предизвика допълнителни спекулации относно тесните връзки на компанията с китайското правителство. Но дори и без това е трудно да не се направи връзка. Още при старта потребителите откриха, че DeepSeek изтрива въпросите относно събитията на площад Тянанмън и всякакви запитвания за Мечо Пух. Беше открито също, че DeepSeek R1 изопачава информация за Китай и не успява да защити данните. Освен това, на разработчиците на модела са били конфискувани паспортите, за да им се попречи да напуснат страната. Следователно тези открития от изследването не са изненада.
В крайна сметка, колкото по-чувствителна е темата за Пекин, толкова по-ненадежден става кодът на DeepSeek. В някои случаи изкуственият интелект просто отказва да помогне, докато в други генерира решение с два пъти повече грешки. Самите разработчици не са коментирали резултатите от проучването, но причините са ясни.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!