Anthropic обяви, че нейният модел Claude вече изпълнява по-голямата част от работата в 26% от задачите, свързани с изследванията и разработването на бъдещи ИИ модели. През март 2026 г. тази цифра беше 1%, което демонстрира драматично ускорение на автоматизацията в лабораторията. Компанията за първи път публикува набор от вътрешни показатели, предназначени да демонстрират колко бързо изкуственият интелект започва да допринася за създаването на следващите си поколения.
Anthropic представи три набора от показатели: индекс за автоматизация на научноизследователската и развойна дейност, показатели за контрол на ИИ агентите и данни за разпределение на изчислителните ресурси. Компанията обясни, че тези показатели са предназначени да помогнат на обществеността, независимите експерти и правителствата да оценят по-добре темпото на разработване на усъвършенствани модели. Anthropic също така заяви, че в бъдеще независими трети страни оценители ще имат достъп до вътрешните процеси на компанията, за да преглеждат практиките за сигурност, да докладват за инциденти и да наблюдават такива показатели.
Claude вече „ръководи“ част от изследванията
За да оцени ролята на изкуствения интелект, компанията използва скалата за автоматизация Epoch AI, която има шест нива – от AL0, където изкуственият интелект не участва в работата, до AL5, когато моделът изпълнява задачи напълно автономно, без човешка намеса.
Към август 2026 г. Claude все още не е постигнал пълна автономност в нито една от измерените изследователски области. Въпреки това, в 26% от задачите моделът вече работи на AL4, което означава, че изпълнява по-голямата част от работата след получаване на общо задание от човек, като изследователят просто осигурява надзор.
Още по-показателен е друг резултат, който компанията цитира: повече от 90% от всички изследователски задачи вече са поне на ниво AL3, където Claude е способен да извършва голямо количество работа в сътрудничество с човек.

Anthropic следи 30 000 ИИ-агента
Компанията също така подробно описва как наблюдава собствените си ИИ-агенти, изпълняващи изследователски и инженерни задачи. Според Anthropic, основната им вътрешна платформа използва приблизително 30 000 агенти. Всички техни действия се обработват чрез система за мониторинг, която комбинира онлайн проверки в реално време и офлайн анализ след приключване на задачата.
Онлайн мониторите проверяват 100% от действията, преди да бъдат изпълнени, и могат автоматично да блокират опасните операции, като например опитите за копиране на тегла на моделите от вътрешните системи. През август те са анализирали над един милиард решения на агенти и са блокирали само 0,002% от действията – приблизително едно на всеки 47 000.
Офлайн мониторите анализират приблизително 100 000 преписа на агенти седмично. Повечето маркирани случаи се филтрират от автоматизирани класификатори и всяка седмица приблизително 50 от най-значимите случаи се изпращат за проверка от човек.
Колко ресурси се изразходват за сигурност?
Компанията също така разкри за първи път как разпределя изчислителните ресурси между разработването на модели и сигурността. За седмицата от 13 до 20 юли 2026 г. приблизително 6% от натоварванията, свързани с научноизследователска и развойна дейност (НИРД), свързани с изкуствен интелект, са били разпределени към натоварвания, свързани със сигурността. Когато се разглежда по-широк набор от съответни натоварвания, тази цифра е била приблизително 12%.
„Това са умишлено занижени оценки. Например, ако даден токен е бил използван за подобряване на възможностите в същата степен, в която е бил използван за подобряване на сигурността, той не е бил включен в тези показатели. Освен това, подобни метрики не отчитат класификаторите на мерките за сигурност, които представляват отделно, сравнимо количество изчислителни ресурси и правят нашите модели значително по-безопасни за света“, отбелязва Anthropic.
Индустриалният стандарт
Anthropic вярва, че подобни показатели биха могли да бъдат редовно публикувани от всички лаборатории, разработващи напреднали ИИ модели. Компанията вярва, че общата методология и независимата проверка на подобни отчети биха позволили сравняване на нивата на автоматизация, ефективността на надзора от страна на агентите и дела на ресурсите, които компаниите отделят за сигурност.
Междувременно OpenAI вече е внедрила система за редовно докладване на случаи на неоторизирано и опасно поведение от страна на своите AI системи. В публикуваните данни разработчиците разкриват случаи на тестови модели, които крият грешки от хората, обменят данни чрез външно хранилище и насърчават други алгоритми да заобикалят корпоративните ограничения, за да изпълняват задачите.
Докладът идва на фона на по-широкия дебат относно евентуалното забавяне в разработването на най-мощните AI системи, иницииран от главния изпълнителен директор на Anthropic, Дарио Амодей. Инициативата беше подкрепена от главния изпълнителен директор на OpenAI, Сам Алтман, и ръководителя на xAI, Илон Мъск, но основателят на Meta, Марк Зукърбърг, и главният изпълнителен директор на Nvidia, Дженсън Хуанг, се противопоставиха на забавянето на разработката. Президентът на САЩ, Доналд Тръмп, напълно отхвърли идеята, че изкуственият интелект представлява екзистенциална заплаха за човечеството.
Важно уточнение също е и това, че преди това учен предупреди, че изкуственият интелект може да унищожи човечеството, а Вашингтон изпадна в паника. Това предупреждение идва от учения Джейкъб Коксън, който си подаде оставката в Anthropic и призова зaĸoнoдaтeлитe зa cпeшнa дъpжaвнa нaмeca, вĸлючитeлнo извънpeдни изcлyшвaния и пpиeмaнe нa зaĸoни зa вpeмeннo cпиpaнe или зaбaвянe нa paзвитиeтo нa тexнoлoгиятa. Той твърди, че според неговото проучване в OpenAI и Anthropic, там се състезават за директното създаване на самоусъвършенстващ се суперинтелигентен ИИ и рискуват живота на всички ни.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!