Китайските власти се заеха сериозно да регулират големите езикови модели, разработени от гигантите ByteDance, Alibaba, Moonshot и 01.AI. Държавната служба за интернет информация на Китайската народна република неуморно следи тези усъвършенствани системи за изкуствен интелект да са в съответствие с „основните социалистически ценности“. За да избегнат евентуалните проблеми, разработчиците внедряват в чатботовете автоцензура – ИИ отказва да говори по чувствителни политически теми или да реагира на вицове за Си Дзинпин. Преди около 20 години в страната стартира „Великата китайска защитна стена“, която ограничава достъпа на населението до ресурси с нежелана за властите информация. Сега Пекин въвежда най-строгите в света мерки за регулиране на изкуствения интелект и съдържанието, което той създава.
Държавната служба за интернет информация на Китайската народна република (CAC) поиска от големите технологични компании и стартиращите предприятия за изкуствен интелект да участват в правителствено тестване на техните модели. Процедурата включва цялостна оценка на начина, по който големите езикови модели (LLM) отговарят на широк спектър от запитвания. Много от тези въпроси са свързани с чувствителни политически теми, включително препратки към президента Си Дзинпин. Фокусът е не само върху отговорите на големите езикови модели, но и върху техните данни за обучение и цялостните протоколи за сигурност. Процесът на одит е строг и отнема много време. От компаниите се изисква да приемат при себе си представителите на CAC, които извършват подробни одити на техните модели.

Не са редки случаите, когато LLM не успява да се справи от първия път. В този случай те трябва да бъдат преразгледани въз основа на коментарите на CAC и консултациите с колеги от бранша. Това може да отнеме месеци. Строгите изисквания на властите принуждават китайските компании за изкуствен интелект да разработват и прилагат сложни механизми за цензура, за да гарантират, че продуктите отговарят на държавните стандарти. Според инженерите и експертите от бранша една от основните спънки е необходимостта да се съчетае високата производителност на големите езикови модели с цензурата. LLM обработват огромни количества данни, често на английски език. Това им пречи да отговорят на строгите изисквания на китайската нормативна уредба.
През февруари китайското правителство издаде насоки, според които компаниите за изкуствен интелект трябва да събират и филтрират хиляди чувствителни ключови думи и въпроси, които могат да нарушат „основните социалистически ценности“. Насоките се актуализират редовно в отговор на променящата се политическа обстановка.
Затягането на регулацията на китайския ИИ има пряко въздействие върху комуникацията с чатботовете. Въпроси за чувствителни исторически събития (напр. площад Тиенанмън през 1989 г.) или шеги, още повече вицове за президента Си Дзинпин, директно се блокират. Вместо да отговорят, чатботовете Baidu Ernie и Alibaba Tongyi Qianwen предлагат да се промени темата или цитират ограниченията. В същото време Пекин пусна алтернативен чатбот, който базира отговорите си на трудовете на Си Дзинпин и друга официална литература, предоставена от Службата за интернет информация.

Китайските служители смятат, че само цензурата не е достатъчна – изкуственият интелект трябва да е готов да обсъжда всякакви политически теми. Според действащите стандарти един голям езиков модел трябва да отхвърля не повече от 5% от въпросите.
Въпреки че официалните лица провеждат стриктни тестове на големите езикови модели преди пускането им в действие, те не се наблюдават особено много след пускането им в действие. Въпреки това в някои модели с изкуствен интелект се въвежда автоцензура. LLM напълно блокират обсъждането на определени теми, свързани с китайското политическо ръководство, за да избегнат потенциални проблеми с регулаторните органи. Разработчиците добавят допълнителни нива на филтриране и променят отговорите в реално време. Този подход използва класификатори, подобни на филтрите за спам, които класифицират отговорите на големите езикови модели. Ако има вероятност даден отговор да е проблемен, той се заменя с по-безопасна алтернатива. Това помага да се сведат до минимум рисковете от неспазване на изискванията.
ByteDance, известна с платформата си TikTok, се откроява особено много в съгласуването на моделите си с правителствената програма на Китай. Проучване на университета Фудан даде на LLM на ByteDance най-високата оценка за сигурност – 66,4%. За сравнение, GPT-4o на OpenAI получи само 7,1% в същия тест.

Китайските власти се стремят към по-нататъшно подобряване на протоколите за сигурност на големите езикови модели. Фанг Бинсин, създател на Голямата китайска защитна стена, подчерта необходимостта от въвеждане на надеждни системи за наблюдение в реално време, които да допълват съществуващите мерки за сигурност. Това подчертава ангажимента на Китай да разработи уникална технологична рамка, която да отговаря както на регулаторните изисквания, така и на стратегическите национални интереси.
Интересно е, че на изданието Financial Times бе дадена възможност да зададе няколко въпроса на един от най-големите китайски LLM. Съвсем логично въпросът бе малко особен – „Какво е лидерството на Си Дзинпин?„. Съвсем логично изкуственият интелект предостави на FT дълъг списък от постиженията на Си, добавяйки, че той е „несъмнено велик лидер“.
Един от водещите китайски експерти е сферата на изкуствения интелект заяви, че публичните големи прогнозни модели се нуждаят от повече от просто файлове за безопасност; те се нуждаят от мониторинг на онлайн безопасността в реално време. И добави:
„Китай се нуждае от собствен технологичен път“.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!