Новият ИИ-модел на Anthropic е способен да управлява компютър

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Миналата пролет Anthropic обяви намерението си да създаде „самообучаващ се ИИ-модел“, който да може самостоятелно да изпълнява повечето офис задачи, което би автоматизирало значителна част от икономиката.

Днес компанията пусна Claude 3.5 Sonnet – нова версия на своя ИИ-модел, който може да взаимодейства с всяко настолно приложение чрез специално API за използване на компютри, като имитира натискане на клавиши, кликвания и жестове с мишката, напълно имитирайки човек.

„Обучихме Claude да вижда какво се случва на екрана и след това да използва наличните софтуерни инструменти, за да изпълнява задачи. Когато разработчикът инструктира Claude да използва даден компютърен софтуер и му дава необходимия достъп, Claude разглежда екранните снимки на това, което вижда потребителят, след което изчислява колко пиксела вертикално или хоризонтално трябва да премести курсора, за да кликне на правилното място.“

съобщават от Anthropic

Подобен инструмент, така нареченият „ИИ-агент“, който може да автоматизира задачи на компютър не е нова идея. Терминът „ИИ-агент“ остава неясно дефиниран, но най-общо се отнася до ИИ, който може да извършва различни действия на компютър. Множество компании вече предлагат такива инструменти – от Microsoft, Salesforce и OpenAI до нови играчи като Relay, Induced AI и Automat.

Някои анализатори смятат, че „ИИ-агентите“ биха могли да предоставят на компаниите по-лесен начин за печелене на милиардите долари, които те влагат в развитието на изкуствения интелект. Според неотдавнашно проучване на Capgemini 10% от организациите вече използват „ИИ-агенти“, а 82% планират да го направят през следващите три години.

Новият ИИ-модел на Anthropic е способен да управлява компютър

Anthropic нарича своята концепция за ИИ-агентите „слой за изпълнение на действия“, който му позволява да изпълнява команди на ниво настолен компютър. Благодарение на възможността за сърфиране в интернет, Claude 3.5 Sonnet може да използва всеки уебсайт и всяко приложение в работния процес.

Каква е разликата между Claude 3.5 Sonnet и други агенти с изкуствен интелект? Anthropic твърди, че това е по-силен, по-стабилен ИИ-модел, който се справя със задачите за кодиране по-добре дори от флагмана o1 на OpenAI, според бенчмарка SWE-bench Verified. Claude самостоятелно коригира и повтаря задачите, когато срещне препятствия и може да работи по цели, които изискват десетки или стотици стъпки.

Въпреки това Anthropic признава, че актуализираният модел има проблеми с основни действия като скролване и мащабиране и може да пропусне кратки събития и известия поради начина, по който прави снимки на екрана и ги обединява. По време на тестовете Claude 3.5 Sonnet успя да изпълни успешно по-малко от половината от задачите.

Новият ИИ-модел на Anthropic е способен да управлява компютър
Резултати от сравнителния анализ на ИИ-моделите на Anthropic

Що се отнася до сигурността, неотдавнашно проучване показа, че дори модели без възможност за използване на настолни приложения, като GPT-4o на OpenAI, могат да участват в злонамерено поведение като например поръчка на фалшив паспорт в даркнет.

Подобни резултати са постигнати от изследователи, използващи различни техники, което води до висок процент успешно изпълнени злонамерени задачи дори за защитени модели. Възможно е ИИ-модел с достъп до управлението на компютъра да нанесе значително повече щети. В допълнение към софтуерните лостове, с които разполага, мрежовите и приложните връзки на модела биха могли да отворят широк спектър от възможности за нападателите.

Anthropic не отрича, че използването на Claude 3.5 Sonnet излага потребителя на допълнителни рискове, но според компанията „много по-добре е да се даде достъп до компютрите на днешните по-ограничени, относително сигурни ИИ-модели. Така ще можем да започнем да наблюдаваме и да се учим от всички потенциални проблеми, които възникват на това по-ниско ниво, като същевременно постепенно и едновременно изграждаме използването на компютъра и мерките за намаляване на рисковете за сигурността.

Заедно с пускането на Claude 3.5 Sonnet, Anthropic обяви предстоящото пускане на обновената версия на Claude 3.5 Haiku.

„С високата си скорост, подобреното придържане към инструкциите и по-точното използване на инструментите Claude 3.5 Haiku е подходящ за продукти, ориентирани към потребителя, специализирани задачи на под-агенти и създаване на персонализирани преживявания от огромни количества данни, като история на покупките, цени или данни за инвентара.“

заяви Anthropic в публикация в блога си

Първоначално Haiku ще бъде достъпен като модел, базиран на текст, а след това като част от мултимодален пакет, който може да анализира както текст, така и изображения.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини