Инженерите губят от ИИ: моделът Claude Opus 4.5 се справи със заданието на Anthropic по-добре от всеки човек

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Вчера Anthropic обяви пускането на пазара на новия си флагмански ИИ-модел Claude Opus 4.5. Компанията по-късно разкри, че в двучасова задача, предложена от самата Anthropic при наемане на служители за инженерни позиции, Opus 4.5 се е представил по-добре от живите участници в теста.

Според Anthropic, производителността на изкуствения интелект е постигната чрез многократно решаване на всяка задача и избиране на най-добрия отговор. Въпреки че тестът не покрива всички компетенции, необходими за това да бъдеш инженер, превъзходството на модела над силните кандидати в ключови технически области предполага, че в бъдеще изкуственият интелект може да трансформира инженерството като професия, съобщава Business Insider.

Подробностите за съдържанието на теста не се разкриват, но отзивите в Glassdoor показват, че през 2024 г. той е включвал четири нива и е изисквал внедряването на специфична система, последвано от добавяне на функционалност. Не е известно дали подобен формат на задачите е бил използван при оценката на новата версия на Claude Opus 4.5, която включва подобрения не само в генерирането на код, но и в създаването на професионални документи, включително електронни таблици в Excel и презентации в PowerPoint.

Според експерти, тази версия продължава да затвърждава водещата позиция на Anthropic в областта на ИИ-програмирането. Дори Meta на Марк Зукърбърг, конкурент в надпреварата за изкуствения интелект, използва Claude за поддръжката на своя вътрешен асистент по кодиране под името Devmate.

Компанията пази в тайна методите си за обучение на ИИ-моделите. Ерик Саймънс, изпълнителен директор на стартъпа Stackblitz, който разработи услугата Bolt.new, обаче преди това предположи, че Anthropic може да използва изкуствен интелект за писане и изпълнение на код, след което да анализира резултатите както с човешки, така и с ИИ-инструменти. Това описание беше потвърдено от Даян Пен, ръководител на отдела за продуктово управление, изследвания и напреднали технологии в Anthropic, наричайки го „като цяло вярно“.

През октомври, главният изпълнителен директор на Anthropic, Дарио Амодей, обяви, че ИИ Claude вече пише 90% от кода за повечето екипи в компанията. Той обаче отбелязва, че това няма да доведе до намаляване на броя на инженерите, а по-скоро ще увеличи търсенето им, тъй като хората ще могат да се съсредоточат върху най-сложните 10% от работата или върху управлението на група от ИИ-модели.

Спомнете си, че Anthropic предизвика Gemini 3, тъй като компанията представи мощния AI-модел Opus 4.5. Също, Claude Opus 4 вече може да прекратява диалога с токсичните потребители. Тоест, ИИ вече може сам да прекрати диалога, ако прецени, че ситуацията е заплашителна не за човека, а за самия него.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

1 Коментар
стари
нови оценка

Нови ревюта

Подобни новини