големи езикови модели

Езиковите ИИ модели са се научили да разпознават емоциите и скритите им значения по-добре от някои хора

Големите езикови ИИ модели вече са способни да разпознават скрито значение, емоции и други тънкости в текстовете, също толкова добре, колкото и хората. Последните проучвания показват, че LLM-ите като GPT-4, Gemini, Llama-3.1-70B и Mixtral 8×7B са способни до известна степен...

Изследване на Pfizer за това защо големите езикови модели изпитват трудности при решаването на проблеми

Нов коментар от изследователи на Pfizer хвърля съмнение върху ключовите изследвания в проучването „Илюзия на мисленето“, съавтор на което са учени от Apple. В статията, написана от Apple, се твърди, че този внезапен спад в производителността сочи към фундаментално ограничение...

Злите близнаци на ChatGPT срещу 100 евро – сега всеки може да стане киберпрестъпник

Според доклад на Cato Networks, киберпрестъпниците продължават активно да използват големи езикови модели (LLM) в своите атаки. По-специално става дума за версии на AI моделите Grok и Mixtral, които са умишлено модифицирани, за да заобикалят вградените ограничения и да...

Всеки напреднал изкуствен интелект сам се е научил да лъже и манипулира – дори когато мисли „на глас“

Лидерите в областта на изкуствения интелект Anthropic, Google, OpenAI и xAI са разработили техника, наречена „вериги от мисъл“, която ни позволява да проследяваме стъпка по стъпка процеса на разсъждение на моделите с изкуствен интелект, докато те генерират отговор на...

Изследователи от Anthropic обучават езиковите модели на самоусъвършенстване

Изследователи от Anthropic са разработили нов метод, наречен “Максимизиране на вътрешната съгласуваност“ (Internal Coherence Maximization, ICM), който фино настройва езиковите модели, използвайки само техните собствени резултати. Този подход би могъл да помогне (или дори да замени) човешкия надзор при...

DeepSeek срещу ChatGPT: Кой води в AI битката

Само за няколко дни китайската компания DeepSeek се превърна от малко известен стартъп в основна тема за обсъждане в технологичната общност. Нейният чатбот се изкачи до върха на класациите на Apple App Store и Google Play, принуждавайки анализаторите от...

Изкуственият интелект не мисли – той само гадае

Съвременните модели на изкуствен интелект се основават на статистически прогнози, а не на истинско разбиране, което създава фундаментални проблеми във функционирането им. Изкуственият интелект, въпреки способността си да имитира човешкия език, не мисли по начина, по който сме свикнали. Работи...

Clippy се завръща от 90-те по-интелигентен, с нов интерфейс и с мисия да бъде полезен

Разработчикът и ентусиаст на старите интерфейси Феликс Рисеберг представи актуализирана версия на Clippy - настолно приложение, което ви позволява да стартирате големи езикови модели (LLM) директно на компютъра си в интерфейс, вдъхновен от ерата на Windows 98. Версия 0.4.1...

Учени с пробив в оптимизацията на ИИ-моделите – те вече могат без нуждата от сървъри или ускорители

Лабораторията за изследване на изкуствения интелект Yandex Research заедно с учени от Националния изследователски университет „Висша школа по икономика“, Масачузетския технологичен институт (MIT), Австрийския институт за наука и технологии (ISTA) и Университета за наука и технологии „Крал Абдула“ в...

DeepSeek е открила как да подобри ефективността на ИИ-моделите с помощта на самообучение

Китайският стартъп DeepSeek се прочу по-рано тази година със своя ИИ-модел R1, способен да "разсъждава", който успя да се конкурира с тези на американските технологични гиганти въпреки скромния си бюджет. Сега DeepSeek публикува статия в сътрудничество с изследователи от...

Бумът на изкуствения интелект съсипва Уикипедия

Уикипедия плаща цената за бума на изкуствения интелект - онлайн енциклопедията е изправена пред нарастващи разходи заради ИИ-роботи, които копират статиите ѝ, за да обучават големи езикови модели, като разхищават ресурси и увеличават трафика и натоварването на сайта. Само...

Meta представи новите си ИИ-модели Llama 4 и ги вгради в WhatsApp, Меssenger и Instagram

Meta обяви пускането на серията големи езикови модели с отворен код Llama 4. Тя включва моделите Llama 4 Scout, Maverick и Behemoth, които предоставят възможности за мултимодално взаимодействие, т.е. могат да отговарят не само на текстови заявки, но и...

Учените най-накрая разбраха как работи изкуственият интелект – оказва се, че той може да планира и умишлено да лъже

Учени от Anthropic са измислили начин да надникнат в механизмите на големите езикови модели, които задвижват приложенията с изкуствен интелект и за първи път са разкрили как технологията обработва информацията и взема решения. Дълго време се смяташе, че е...

Всички съвременни ИИ се провалиха на нов сложен тест за обща интелигентност – хората също не се справиха добре с него

Arc Prize Foundation, организация с нестопанска цел, основана от известния изследовател на изкуствения интелект Франсоа Шоле обяви в блога си създаването на нов, по-усъвършенстван тест за измерване на цялостната интелигентност на водещите ИИ-модели. Новият тест, наречен ARC-AGI-2 постави в затруднение...

OpenAI предлага забрана на ИИ-моделите на DeepSeek в САЩ

Както често се случва с авангардните китайски технологии, разработките на DeepSeek бързо намериха противници извън Китай. Конкурентната американска организация OpenAI излезе с предложение да се забрани в САЩ използването на големите езикови модели не само на DeepSeek, но и...

Exo – помощна програма за разпределено стартиране на ИИ-модели на всякакъв хардуер

Големите езикови модели на изкуствения интелект изискват значителни ресурси не само за обучение, но и за стартиране - необходими са значителни количества оперативна памет и мощни графични процесори. Алтернатива беше предложена от създателите на Exo, безплатна програма за разпределено...

Как мащабирането по време на тестване разкрива скритите способности за разсъждение в малките езикови модели

Много малките езикови модели (SLM) могат да надминат водещите големи езикови модели (LLM) в задачите за разсъждение, според  ново проучване на Shanghai Artificial Intelligence Lab. Авторите показват, че с правилните инструменти и техники за мащабиране по време на тестването,...

Програмисти, спете спокойно: Изкуственият интелект е далеч от това да ви замени

OpenAI провери как големите езикови модели (LLM) се справят с програмирането и дали както се опасяват мнозина от нас, те скоро ще заменят хората в първите редици на развойната дейност. В рамките на теста компанията взе 1488 задачи от...

DarkMind: хакерите са се научили как да препрограмират мисленето на изкуствения интелект

Изследователи от университета в Сейнт Луис представиха нов вид атака срещу големи езикови модели (LLM), която се оказа практически невидима за традиционните системи за защита. Специалистите описаха уязвимости, свързани с метода за разсъждение Chain-of-Thought (CoT), който се използва широко...

Големите ИТ компании в САЩ ще похарчат над 300 млрд. долара за разработване на ИИ през тази година

Водещите технологични компании в САЩ продължават да увеличават разходите си за изкуствен интелект (ИИ) въпреки пазарните рискове. Капиталовите разходи през 2024 гoдина на Microsoft, Alphabet, Amazon и Meta достигнаха рекордните 246 млрд. долара, което е с 63% повече в...

Anthropic представи нов метод за защита на големите езикови модели от хакове

Две години след появата на ChatGPT, на пазара се появиха много големи езикови модели (LLM) и почти всички от тях все още е уязвим на хакове — специални заявки и други решения, които ги карат да генерират злонамерено съдържание. Разработчиците...

Fortune: „Пазарът греши“: DeepSeek не застрашава NVIDIA и други американски ИТ гиганти

Нарастването на популярността на технологиите с изкуствен интелект помогна пазарната стойност на NVIDIA да надхвърли 3 трилиона долара, но в понеделник акциите на компанията поевтиняха със 17%, което доведе до спад на пазарната ѝ стойност с близо 600 милиарда...

Google е с една стъпка по-близо до създаването на ИИ, който мисли като човек

Преди повече от 7 години Google направи пробив, като разработи архитектурата на невронната мрежа Transformer, която сега е в основата на генеративните приложения с изкуствен интелект, включително ChatGPT на OpenAI. Сега компанията представи новата си архитектура Titans - нова...

Възраждането на ELIZA: Първият чатбот в историята възкръсна след 60 години

Група учени от САЩ и Обединеното кралство са успели да съживят работата на първия в историята цифров чатбот ELIZA, създаден през далечната 1966 година. Откритието върна към живот програмата, разработена от професора от Масачузетския технологичен институт Джоузеф Вайзенбаум. През 2021...

От стотици години до месеци: Как ИИ намалява обема на работата, свързана с пренасянето на код

Google активно използва свои собствени инструменти, базирани на изкуствен интелект за модернизиране на вътрешните си кодови бази. В неотдавнашен изследователски документ компанията описва как големите езикови модели (LLM) са помогнали да се намали времето за миграция на кода стотици...

Нови ревюта

На вид е Yoga, отвътре е малка работна станция: тествахме Lenovo Yoga Pro 7i Gen 11

Има един много прост тест за лаптоп, който претендира, че е направен за хора, работещи в движение: колко често се налага да правиш компромис,...

Най-четени