Изследователи от компанията Mindgard твърдят, че са заобиколили ограниченията на чатбота Claude на Anthropic без директни заявки. Самият модел е предлагал забранено съдържание, вариращо от зловреден софтуер до инструкции за създаване на експлозиви, съобщава The Verge.
Anthropic, компанията, която се...
Изследователите на Anthropic публикуваха нова статия, в която се твърди, че големите езикови модели могат да притежават вътрешни „емоционални“ представи, които пряко влияят на тяхното поведение. В модела Claude Sonnet 4.5 изследователите са идентифицирали 171 стабилни състояния, съответстващи на...
Новият ИИ модел Anthropic Claude Sonnet 4.5 в някои случаи се е научил да разбира кога го тестват и за какво се използва — това може да повлияе върху неговата скорост и сигурност, съобщава Fortune.
Подобрената „ситуационна осведоменост“ — способността...
Anthropic обяви Claude Sonnet 4.5 - най-мощният голям езиков модел от семейството Claude до момента. Според разработчиците той е насочен към програмиране, изграждане на агенти с изкуствен интелект и решаване на сложни проблеми. От Anthropic увериха, че Sonnet 4.5...