Anthropic, един от основните конкуренти на OpenAI, пусна Claude 3.7 Sonnet — своят първия „хибриден модел на разсъждение„. Компанията твърди, че може да решава по-сложни проблеми от своите предшественици и ги превъзхожда в области като математика и кодиране.
Claude 3.7 Sonnet вече е достъпен в приложенията на Claude и уеб-версията на чатбота, включително за безплатните потребители. Можете също така да взаимодействате с новата невронна мрежа чрез Anthropic API, Amazon Bedrock и Vertix AI на Google Cloud — новият продукт струва толкова като своя предшественик, 3.5 Sonnet, или $3 за милион входни токени и $15 за милион изходни токени.

OpenAI и други компании предлагат модели с възможности за разсъждение, които са отделни от обикновените генеративни AI-модели. Anthropic реши да ги комбинира в една система, за да получи универсално решение. В резултат на това потребителят може да избере кога моделът Claude 3.7 Sonnet да реагират нормално и кога да помисли по-дълго за отговора. В стандартен режим Claude 3.7 Sonnet е просто подобрена версия на предишния Claude 3.5 Sonnet с по-нови данни (неговата база данни включва информация до ноември 2024 г.). В режим на разширено мислене AI мисли сам, преди да отговори, което подобрява производителността при решаване на задачи по математика, физика, следване на сложни инструкции, кодиране и много други.
Ръководителят на продуктовото проучване на Anthropic Даян Пен каза пред The Verge, че компанията иска да направи модела по-лесен за използване. „По същество смятаме, че разсъжденията — това са по-скоро особености на ИИ, отколкото напълно отделно нещо“ — казва тя, отбелязвайки, че не отнема много време на Claude да отговори на въпроса „колко е часът?“ за разлика от отговора на по-сложно запитване като „планирайте двуседмично пътуване до Италия, имайки предвид времето в края на март“.

В допълнение към новия модел, Anthropic пусна и „ограничена изследователска предварителна версия“ на своя ИИ-агент за програмиране, наречен Claude Code. Anthropic дори вече предлага ИИ-инструменти за кодинг като Cursor, компанията позиционира новия си Claude Code като „активен сътрудник, който може да търси и чете код, да редактира файлове, да пише и изпълнява тестове, да фиксира и изпраща код към GitHub и да използва инструменти от командния ред“.

Anthropic също така позволява на разработчиците да контролират как моделът „мисли“ и дори да определят времеви лимит за мислене. „Понякога разработчикът просто трябва да каже, че отговорът на този въпрос не трябва да отнема повече от 200 милисекунди“ — отбелязва Майкъл Герстенхабер, вицепрезидент в Anthropic по продуктите.

Пен казва, че Claude 3.7 Sonnet е забележимо по-добър от своите конкуренти при справяне с „агентско кодиране“, финансови и правни задачи. Говорителката на Anthropic казва още, че служителите на компанията активно използват новия модел за създаване на дизайн на уебсайтове, интерактивни игри и дори прекарват до 45 минути в кодиране, „създаване на тестови задачи и итеративно редактиране на тестови примери“.

Пен също така казва, че компанията тества моделите си за способността им да играят олдскул видео играта Pokémon, симулирайки натискане на бутони на контролера чрез API. Claude 3.5 Sonnet не успява да избяга от Pallet Town в началото на играта, докато версия 3.7 успява да победи няколко босове.
Пускането на Claude 3.7 Sonnet показва, че AI-индустрията се движи към предлагането на един модел, който може едновременно да реагира бързо и да мисли за сложни проблеми, вместо няколко отделни модела. Изпълнителният директор на OpenAI Сам Алтман наскоро говори за нещо подобно.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!