GPT-5 е издържал тест за пространствено мислене – резултатът изненада дори учените

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Изследователи от SenseTime Research и S-Lab в Технологичния университет в Нанянг представиха подробен технически доклад за напредъка на мултимодалните големи езкови модели в областта на пространственото възприятие и логиката. Те са използвали осем най-съвременни еталона за оценка и са изразходвали над един милиард жетона за тестване.

За да сведат разнородните тестове до единен стандарт, авторите предложиха универсална рамка от 6 основни пространствени умения:

  1. Meтрична оценка
  2. Mислена реконструкция
  3. Пространствени отношения
  4. Смяна на перспективата
  5. Деформация
  6. Сглобяване и сложни разсъждения

Това унифицира подхода за тестване и позволява AI моделите да бъдат сравнявани на обща основа. За всяка категория статията се позовава на източници, включващи концепцията за пространствена интелигентност, концепцията за мисловна ротация и подхода на веригата на разсъжденията.

Документът стандартизира системните подкани, шаблоните за отговори и показателите. За въпросите с въпроси с избор между няколко отговора беше използвана коригирана с шанса точност (CAA), за да се компенсира ефектът от гадаенето. За числовите задачи е използвана средната относителна точност (MRA) за оценка на точността, като се отчита допустимото отклонение.

На фона на своите конкуренти GPT-5 уверено се превърна в лидер.

По-специално, в подзадачите, свързани с оценка на разстоянието и разбиране на пространственото местоположение на обектите, неговите резултати са равни на тези на хората. AI моделът уверено превъзхожда Gemini-2.5-Pro и цялата гама InternVL. Въпреки това в по-трудните категории (като например мислено сглобяване на обекти, смяна на перспективи или симулиране на действия) разликата с хората все още е голяма.

Особено интересно е, че в най-трудните случаи затворените AI модели като GPT-5 нямат ясно изразено предимство пред отворените конкуренти. Това прави подобни задачи перспективни за цялата изследователска общност.

Особено внимание в изследването е отделено на режимите на мислене на модела. Колкото повече GPT-5 изразходва „токени за мислене“, толкова по-точен е отговорът – но само до определена граница. Когато мисли твърде задълбочено, GPT-5 често се сблъсква с прекъсвания и съкратени отговори. Най-балансираните резултати се постигат със средно ниво на усилие.

Като цяло изследването показва важна промяна: AI моделите вече са уверени в основните задачи, при които се изисква оценка на размера и разположението. Когато обаче се появява пълно триизмерно въображение, способност за пренареждане на мисловни образи и извършване на логически операции в пространството, GPT-5 все още е далеч от хората. Пространственият интелект остава една от най-предизвикателните и интересни граници за изкуствения интелект досега.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини