Големите езикови ИИ модели вече са способни да разпознават скрито значение, емоции и други тънкости в текстовете, също толкова добре, колкото и хората.
Последните проучвания показват, че LLM-ите като GPT-4, Gemini, Llama-3.1-70B и Mixtral 8×7B са способни до известна степен...
Нов коментар от изследователи на Pfizer хвърля съмнение върху ключовите изследвания в проучването „Илюзия на мисленето“, съавтор на което са учени от Apple.
В статията, написана от Apple, се твърди, че този внезапен спад в производителността сочи към фундаментално ограничение...
Според доклад на Cato Networks, киберпрестъпниците продължават активно да използват големи езикови модели (LLM) в своите атаки. По-специално става дума за версии на AI моделите Grok и Mixtral, които са умишлено модифицирани, за да заобикалят вградените ограничения и да...
Лидерите в областта на изкуствения интелект Anthropic, Google, OpenAI и xAI са разработили техника, наречена „вериги от мисъл“, която ни позволява да проследяваме стъпка по стъпка процеса на разсъждение на моделите с изкуствен интелект, докато те генерират отговор на...
Изследователи от Anthropic са разработили нов метод, наречен “Максимизиране на вътрешната съгласуваност“ (Internal Coherence Maximization, ICM), който фино настройва езиковите модели, използвайки само техните собствени резултати. Този подход би могъл да помогне (или дори да замени) човешкия надзор при...
Само за няколко дни китайската компания DeepSeek се превърна от малко известен стартъп в основна тема за обсъждане в технологичната общност. Нейният чатбот се изкачи до върха на класациите на Apple App Store и Google Play, принуждавайки анализаторите от...
Съвременните модели на изкуствен интелект се основават на статистически прогнози, а не на истинско разбиране, което създава фундаментални проблеми във функционирането им.
Изкуственият интелект, въпреки способността си да имитира човешкия език, не мисли по начина, по който сме свикнали. Работи...
Разработчикът и ентусиаст на старите интерфейси Феликс Рисеберг представи актуализирана версия на Clippy - настолно приложение, което ви позволява да стартирате големи езикови модели (LLM) директно на компютъра си в интерфейс, вдъхновен от ерата на Windows 98. Версия 0.4.1...
Лабораторията за изследване на изкуствения интелект Yandex Research заедно с учени от Националния изследователски университет „Висша школа по икономика“, Масачузетския технологичен институт (MIT), Австрийския институт за наука и технологии (ISTA) и Университета за наука и технологии „Крал Абдула“ в...
Китайският стартъп DeepSeek се прочу по-рано тази година със своя ИИ-модел R1, способен да "разсъждава", който успя да се конкурира с тези на американските технологични гиганти въпреки скромния си бюджет. Сега DeepSeek публикува статия в сътрудничество с изследователи от...
Уикипедия плаща цената за бума на изкуствения интелект - онлайн енциклопедията е изправена пред нарастващи разходи заради ИИ-роботи, които копират статиите ѝ, за да обучават големи езикови модели, като разхищават ресурси и увеличават трафика и натоварването на сайта. Само...
Meta обяви пускането на серията големи езикови модели с отворен код Llama 4. Тя включва моделите Llama 4 Scout, Maverick и Behemoth, които предоставят възможности за мултимодално взаимодействие, т.е. могат да отговарят не само на текстови заявки, но и...
Учени от Anthropic са измислили начин да надникнат в механизмите на големите езикови модели, които задвижват приложенията с изкуствен интелект и за първи път са разкрили как технологията обработва информацията и взема решения. Дълго време се смяташе, че е...
Arc Prize Foundation, организация с нестопанска цел, основана от известния изследовател на изкуствения интелект Франсоа Шоле обяви в блога си създаването на нов, по-усъвършенстван тест за измерване на цялостната интелигентност на водещите ИИ-модели.
Новият тест, наречен ARC-AGI-2 постави в затруднение...
Както често се случва с авангардните китайски технологии, разработките на DeepSeek бързо намериха противници извън Китай. Конкурентната американска организация OpenAI излезе с предложение да се забрани в САЩ използването на големите езикови модели не само на DeepSeek, но и...
Големите езикови модели на изкуствения интелект изискват значителни ресурси не само за обучение, но и за стартиране - необходими са значителни количества оперативна памет и мощни графични процесори. Алтернатива беше предложена от създателите на Exo, безплатна програма за разпределено...
Много малките езикови модели (SLM) могат да надминат водещите големи езикови модели (LLM) в задачите за разсъждение, според ново проучване на Shanghai Artificial Intelligence Lab. Авторите показват, че с правилните инструменти и техники за мащабиране по време на тестването,...
OpenAI провери как големите езикови модели (LLM) се справят с програмирането и дали както се опасяват мнозина от нас, те скоро ще заменят хората в първите редици на развойната дейност. В рамките на теста компанията взе 1488 задачи от...
Изследователи от университета в Сейнт Луис представиха нов вид атака срещу големи езикови модели (LLM), която се оказа практически невидима за традиционните системи за защита. Специалистите описаха уязвимости, свързани с метода за разсъждение Chain-of-Thought (CoT), който се използва широко...
Водещите технологични компании в САЩ продължават да увеличават разходите си за изкуствен интелект (ИИ) въпреки пазарните рискове. Капиталовите разходи през 2024 гoдина на Microsoft, Alphabet, Amazon и Meta достигнаха рекордните 246 млрд. долара, което е с 63% повече в...
Две години след появата на ChatGPT, на пазара се появиха много големи езикови модели (LLM) и почти всички от тях все още е уязвим на хакове — специални заявки и други решения, които ги карат да генерират злонамерено съдържание.
Разработчиците...
Нарастването на популярността на технологиите с изкуствен интелект помогна пазарната стойност на NVIDIA да надхвърли 3 трилиона долара, но в понеделник акциите на компанията поевтиняха със 17%, което доведе до спад на пазарната ѝ стойност с близо 600 милиарда...
Преди повече от 7 години Google направи пробив, като разработи архитектурата на невронната мрежа Transformer, която сега е в основата на генеративните приложения с изкуствен интелект, включително ChatGPT на OpenAI.
Сега компанията представи новата си архитектура Titans - нова...
Група учени от САЩ и Обединеното кралство са успели да съживят работата на първия в историята цифров чатбот ELIZA, създаден през далечната 1966 година. Откритието върна към живот програмата, разработена от професора от Масачузетския технологичен институт Джоузеф Вайзенбаум.
През 2021...
Google активно използва свои собствени инструменти, базирани на изкуствен интелект за модернизиране на вътрешните си кодови бази. В неотдавнашен изследователски документ компанията описва как големите езикови модели (LLM) са помогнали да се намали времето за миграция на кода стотици...