Изследователи от SenseTime Research и S-Lab в Технологичния университет в Нанянг представиха подробен технически доклад за напредъка на мултимодалните големи езкови модели в областта на пространственото възприятие и логиката. Те са използвали осем най-съвременни еталона за оценка и са изразходвали над един милиард жетона за тестване.
За да сведат разнородните тестове до единен стандарт, авторите предложиха универсална рамка от 6 основни пространствени умения:
- Meтрична оценка
- Mислена реконструкция
- Пространствени отношения
- Смяна на перспективата
- Деформация
- Сглобяване и сложни разсъждения
Това унифицира подхода за тестване и позволява AI моделите да бъдат сравнявани на обща основа. За всяка категория статията се позовава на източници, включващи концепцията за пространствена интелигентност, концепцията за мисловна ротация и подхода на веригата на разсъжденията.
Документът стандартизира системните подкани, шаблоните за отговори и показателите. За въпросите с въпроси с избор между няколко отговора беше използвана коригирана с шанса точност (CAA), за да се компенсира ефектът от гадаенето. За числовите задачи е използвана средната относителна точност (MRA) за оценка на точността, като се отчита допустимото отклонение.
На фона на своите конкуренти GPT-5 уверено се превърна в лидер.
По-специално, в подзадачите, свързани с оценка на разстоянието и разбиране на пространственото местоположение на обектите, неговите резултати са равни на тези на хората. AI моделът уверено превъзхожда Gemini-2.5-Pro и цялата гама InternVL. Въпреки това в по-трудните категории (като например мислено сглобяване на обекти, смяна на перспективи или симулиране на действия) разликата с хората все още е голяма.
Особено интересно е, че в най-трудните случаи затворените AI модели като GPT-5 нямат ясно изразено предимство пред отворените конкуренти. Това прави подобни задачи перспективни за цялата изследователска общност.
Особено внимание в изследването е отделено на режимите на мислене на модела. Колкото повече GPT-5 изразходва „токени за мислене“, толкова по-точен е отговорът – но само до определена граница. Когато мисли твърде задълбочено, GPT-5 често се сблъсква с прекъсвания и съкратени отговори. Най-балансираните резултати се постигат със средно ниво на усилие.
Като цяло изследването показва важна промяна: AI моделите вече са уверени в основните задачи, при които се изисква оценка на размера и разположението. Когато обаче се появява пълно триизмерно въображение, способност за пренареждане на мисловни образи и извършване на логически операции в пространството, GPT-5 все още е далеч от хората. Пространственият интелект остава една от най-предизвикателните и интересни граници за изкуствения интелект досега.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!