контекстно учене

Провалът на контекста: Новият бенчмарк на Tencent разкрива „интелектуалната дупка“ в съвременния ИИ

Tencent и университетът Fudan представиха CL-bench - отворен бенчмарк, който оценява способността на езиковите модели да извличат знания от предоставен контекст, вместо да разчитат на данни от обучението. Тестовете показаха тревожно слаби резултати: дори най-мощният модел, GPT-5.1, реши правилно...

Нови ревюта

На вид е Yoga, отвътре е малка работна станция: тествахме Lenovo Yoga Pro 7i Gen 11

Има един много прост тест за лаптоп, който претендира, че е направен за хора, работещи в движение: колко често се налага да правиш компромис,...

Най-четени