OpenAI представи новия си езиков модел „o1“, който има способността да разсъждава и да решава проблеми. За разлика от предишните модели, o1 е в състояние да имитира човешкия мисловен процес, като разделя сложните задачи на по-прости стъпки, анализира различни подходи и коригира собствените си грешки.
Големият езиков модел (LLM) o1 се представи отлично в тестове и състезания, сравними с човешки експерти. В областта на програмирането o1 се класира на 49-то място в Международната олимпиада по информатика (IOI) през 2024 година и надмина 89% от хората в платформата Codeforces. В областта на математиката o1 се класира сред 500-те най-добри ученици в САЩ на квалификационния кръг на Американската математическа олимпиада (AIME), демонстрирайки способността си да решава задачи, предназначени за най-надарените ученици, съобщи OpenAI на своя уебсайт.

В областта на природните науки моделът надминава резултатите на доктори и докторанти в трудния диамантен тест GPQA, който оценява знанията в областта на химията, физиката и биологията.
„Това не означава, че o1 е по-интелигентен от всеки кандидат за доктор на науките. То обаче показва, че моделът е способен да решава някои задачи на нивото на висококвалифицирани специалисти.“
обясняват разработчиците
Моделът o1 демонстрира и превъзходство над предишни ИИ-модели в различни тестове за интелигентност и решаване на задачи, включително MMMU и MMLU.
Според OpenAI новият модел значително превъзхожда своя предшественик GPT-4o при повечето задачи, свързани с логическо мислене.
„Нашите тестове показаха, че o1 последователно подобрява представянето си с увеличаване на количеството на обучението за пренастройване и времето, прекарано в мислене.“
отбелязва компанията
По-конкретно, в тестовете на AIME o1 решава средно 83% от задачите в сравнение с 13% на GPT-4o. Моделът o1 е значително по-малко халюциниращ от GPT-4o. Той обаче е по-бавен и по-скъп. Освен това o1 отстъпва на GPT-4o по отношение на енциклопедичните знания и не може да обработва уеб страници, файлове и изображения. Освен това новият модел може да манипулира данни, като напасва решението към резултата.
Тайната на успеха се крие в принципно нов алгоритъм на обучение – „верига от мисли“. Моделът е в състояние да усъвършенства тази верига, като се учи с помощта на методология за усилено учене, чрез която разпознава и коригира грешките си, разделя сложните стъпки на по-прости и опитва различни подходи за решаване на проблеми. Тази методология значително подобрява способността за разсъждение на модела, който „подобно на човешкото същество може да мисли дълго време, преди да отговори на сложен въпрос“.
OpenAI вече пусна предварителна версия на модела o1-preview, която е достъпна за използване в ChatGPT и за разработчици чрез API. Компанията признава, че все още предстои много работа, за да направи o1 толкова лесен за използване, колкото и настоящите модели. Подчертава се и безопасността и етичността на новия модел, тъй като разсъжденията му могат да бъдат наблюдавани, което предотвратява потенциално нежелано поведение. Преди да бъде пуснат o1-preview за публична употреба бяха проведени тестове за сигурност от страна на OpenAI.
Цената за използване на o1-preview е 15 долара за 1 милион входни токена и 60 долара за 1 милион изходни токена. За сравнение, GPT-4o се предлага на цена от 5 долара за 1 милион входни токена и 15 долара за 1 милион изходни токена.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!