Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

Международната федерация по кореспондентен шах (ICCF) се сблъска с проблем, който поставя под въпрос смисъла на състезанието в сегашния му вид. В кореспондентния шахмат, където на играчите официално е разрешено да използват компютърни енджини за анализ на позициите, нивото на игра е достигнало почти абсолютна прецизност. В резултат на това се стигна до постоянни ремита: на елитното ниво до 95% от партиите завършват по този начин.

Традиционните рейтингови системи, като Elo, се оказаха неспособни да оценят адекватно силата на играчите в условията на тотално равенство. Това доведе до застой в класациите и до невъзможност да се определи истинският лидер. В отговор на това професорът по статистика от Харвардския университет Марк Гликман, автор на известната система Glicko, разработи принципно нов математически модел. Неговият подход предлага да се изостави линейното възприемане на резултата и да се въведе зависимост на вероятността за равенство от абсолютната сила на съперниците.

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат

Архитектурата на проблема: защо системата Elo вече е остаряла

Рейтинговата система на Арпад Ело, разработена в средата на 20-ти век, се основава на модела на Брадли-Тери. Нейният основен принцип е, че изходът от играта зависи единствено от разликата в рейтингите на двамата опоненти. Ако рейтингът на играч А е с 200 точки по-висок от този на играч Б, системата предвижда определена вероятност за победа на А (например 76%).

В тази парадигма ремито се разглежда като междинен резултат, еквивалентен на половин победа и половин загуба. Системата на Elo приема, че вероятността за равенство е или константа, или зависи от близостта на рейтингите на противниците един до друг. Тя обаче напълно пренебрегва абсолютните нива на умения. За формулата на Elo равенство в партия на двама начинаещи, които правят по десет груби грешки на партия, е математически идентично с реми в партия на два суперкомпютъра, които играят перфектно.

В действителност тези събития са от съвсем различно естество. При слабите играчи ремито често е резултат от взаимните грешки, които се уравновесяват. При елитните играчи ремито е следствие от липсата на грешки. Когато и двамата опоненти играят без грешки, играта неизбежно стига до мирен изход. Пренебрегването на този факт доведе до това, че рейтинговата система в кореспондентния шахмат престана да функционира като инструмент за измерване. Разликата между играч с рейтинг 2500 и играч с рейтинг 2800 беше заличена, тъй като и двамата играят до реми с вероятност, близка до единица.

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат
Вероятността за реми в зависимост от средния рейтинг на играчите. Графиката показва как честотата на ремитата се увеличава с нарастването на уменията на противниците (коригирани спрямо разликата в силата им). Защрихованата област е 95% доверителен интервал.

Хипотезата на Гликман: силата на играча като фактор за ремитата

Марк Гликман предлага да се разшири класическият модел на сравненията по двойки, като се въведат нови променливи. Неговата система се основава на твърдението, че вероятността за реми функционално зависи от комбинираното умение на противниците.

В предложения модел резултатът от играта се определя не само от разликата в силите, но и от тяхната сума или средна стойност. Колкото по-висок е средният рейтинг на двойката, толкова по-висока е основната вероятност за равен резултат.

Механиката на процеса е описана по следния начин:

  1. Нисък рейтинг: играчите са нестабилни. Вероятността за успешен изход (победа/загуба) е висока, тъй като изходът на играта се решава от груби грешки. Моделът на Гликман приписва на тези игри ниска вероятност за реми.
  2. Висок рейтинг: играчите (особено тези, които използват енджини) са ефективни в неутрализирането на заплахите. Способността за защита нараства по-бързо от способността за атака. Моделът на Гликман предвижда висока вероятност за реми при такива двойки.

Това променя подхода към точкуването. Ако двама слаби играчи направят реми, това е неочакван резултат за системата, който сближава техните рейтинги. Ако двама шампиони направят реми, системата го възприема като очаквано събитие с малко информация. В резултат на това техните рейтинги се променят незначително. По този начин се решава проблемът с нестабилността и инфлацията на рейтингите на най-високо ниво.

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат
Промяната на рейтинга след партия срещу противници с различна сила

Цветовата асиметрия: предимството на първия ход

Вторият важен аспект от изследването на Гликман е да анализира предимството на играта с белите фигури. Традиционната статистика отчита, че белите печелят по-често, но това предимство обикновено се смята за фиксирана стойност за всички играчи.

Гликман анализира данните от откритите турнири по шахмат на САЩ (US Chess Open), проведени лице в лице, и установява, че предимството на белите фигури корелира и със силата на играчите.

  1. Слабите играчи не умеят да задържат инициативата на първия ход. Предимството им се изравнява още в дебюта поради неточности.
  2. Силните играчи са в състояние да трансформират минималното предимство в дебюта в дългосрочен позиционен натиск.

Статистическият анализ показва: колкото по-висок е рейтингът на даден играч, толкова по-висока е вероятността за неговата победа с белите (при равни други условия). Математически това се изразява чрез въвеждането на допълнителен параметър в уравнението на логистичната регресия, който мащабира „бонуса за белите“ в зависимост от рейтинга.

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат

При въвеждането на новата система в ICCF обаче беше решено този фактор да не се взема предвид. Причината не е в областта на математиката, а в областта на спортната етика. Игровата общност сметна за несправедлива система, която предварително отрежда на по-силния играч, играещ с белите, още по-високи математически очаквания за победа. В окончателния вариант на алгоритъма, приет от федерацията, параметрите, отговорни за предимството на цвета, бяха нулирани, въпреки статистическата им значимост.

Байесовият подход и динамиката във времето

Гликман използва Байесовия метод на пространството на състоянията, за да приложи своя модел. За разлика от класическото Elo, при което класирането е точкова стойност, системата на Гликман описва силата на играча като вероятностно разпределение (нормално разпределение с параметри средна стойност и дисперсия).

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат

Ключова характеристика на системата е динамичното изменение на неопределеността във времето.

  1. Случайно движение: силата на играча не се разглежда като фиксирана константа. Тя се развива от период в период. Дори ако даден играч не играе, системата увеличава параметъра на неопределеност (дисперсията) на неговия ранг. Това отразява факта, че знаем по-малко за силата на играч, който не е сядал на дъската дълго време.
  2. Филтрация: за актуализиране на рейтингите се използва алгоритъм, който апроксимира сложни интеграли (чрез квадратурата на Гаус-Хермит и метода на Нютон-Рафсън). Това позволява преизчисляване на рейтингите итеративно, период по период, без да се налага всеки път да се обработва цялата история на играта отначало.

Този подход дава възможност на системата бързо да реагира на промените във формата на играчите, като същевременно остава стабилна при наличието на редки случайни резултати.

Резултати от прилагането в ICCF

Новата система беше тествана върху набор от данни на ICCF, обхващащ периода от 2016 г. до 2022 г. (около 400 000 партии). Сравненията бяха направени с помощта на метриката за кръстосана ентропия, която оценява точността на вероятностните прогнози.

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат

Моделът на Гликман показа значително по-добра способност за прогнозиране в сравнение с класическата система Elo. Но основният резултат беше коригирането на структурните отклонения в таблицата за класиране:

Елиминиране на инфлацията: в старата система рейтингите на най-добрите играчи необосновано нарастваха над границата от 3000 точки, което не отразяваше реалната разлика в класите. Новата система коригира тези стойности, като ги върна в един реалистичен диапазон.

Стабилизация: Системата вече не санкционира елитните играчи, като намалява рейтинга им за поредица от равенства срещу равностойни съперници. Тъй като моделът вече очаква равенство, рейтингът на играча остава стабилен при мирни резултати, което е в съответствие с логиката на играта на най-високо ниво.

Когато никой не греши: защо рейтингът Elo престана да функционира в съвременния шахмат
Сравнение на новите ранглисти (вертикално) със старите ранглисти Elo (хоризонтално) към март 2022 г.

Значимостта на анализа на системите за съревнования

Работата на Марк Гликман демонстрира прехода от прости линейни показатели към сложни вероятностни модели при оценката на компетентността. Това има значение не само за шахмата, но и за всяка конкурентна среда, в която нивото на уменията на състезателите се приближава до границата и цената на грешката става критична.

Киберспортовете, алгоритмичната търговия и системите за класиране на AI агентите показват подобна тенденция: с усъвършенстването на стратегиите ефективността на действията намалява и равенствата или несигурните резултати стават норма. Гликман показа, че в такива системи не може да се използва универсална линийка, която да пасва на всички. Инструментът за измерване трябва да се адаптира към измервания обект: метриките, които работят за начинаещите, са безполезни за професионалистите.

Въвеждането на системата на Гликман в ICCF през 2023 г. беше първият път, в който голяма спортна федерация официално призна зависимостта на вероятността за реми от силата на играта, вписвайки този факт в математическото ядро на своите състезания. Това бележи края на ерата на Elo и прехода към по-нюансирана оценка на интелектуалното превъзходство.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини