През декември OpenAI представи своя разсъждаващ модел с изкуствен интелект o3 и показа резултати от бенчмарка ARC-AGI, който представлява най-предизвикателният тест за оценка на възможностите на AI. Сега резултатите от тестовете трябваше да бъдат преразгледани и изглеждат по-малко впечатляващи:...