Inception представи Mercury-2: Първата в света дифузионна моделна архитектура за логическо мислене

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

Американският стартъп Inception представи Mercury 2 – първия езиков модел, който използва дифузионна архитектура вместо традиционната авторегресия, което му позволява да генерира текст пет пъти по-бързо от съществуващите аналози. Вместо последователно да прогнозира лексемите, моделът създава проект на отговора в неговата цялост и итеративно го подобрява – генераторите на видео и снимки работят по подобен начин. В резултат на това Mercury 2 постига скорост от над 1000 лексеми в секунда, като качеството му е сравнимо с това на Claude 4.5 Haiku и GPT-5.2 Mini.

Днес почти всички езикови модели, включително решенията на OpenAI, Anthropic и Google DeepMind, работят на базата на авторегресивна архитектура – те генерират текста последователно, лексема по лексема. Този подход ограничава скоростта: колкото по-задълбочени са разсъжденията, толкова по-висока е латентността и разходите. В отговор на това индустрията е инвестирала милиарди долари в ускорителни чипове, оптимизация на инфраструктурата и модели за компресия, но самият принцип на последователно генериране остана непроменен.

Mercury 2 предлага алтернатива – архитектура, базирана на дифузия. Вместо постепенно да предвижда следващия токен, моделът генерира проект на отговор в неговата цялост и след това итеративно го усъвършенства чрез паралелна обработка на множество токени. Този подход, използван преди предимно при генерирането на изображения и видео, позволява радикално подобряване на производителността, без да се налага да се разчита единствено на хардуерна оптимизация.

Inception представи Mercury-2: Първата в света дифузионна моделна архитектура за логическо мислене

Според компанията Mercury 2 постига скорости, надвишаващи 1000 токена в секунда, на графични процесори NVIDIA Blackwell, като същевременно осигурява производителност, сравнима с Claude 4.5 Haiku и GPT-5.2 Mini. Моделът поддържа контекстен прозорец с до 128 000 токена. Той получи 91,1 точки на AIME 2025 в стандартните бенчмаркове и сравними резултати в задачите за програмиране, научни изчисления и логически анализ. Заявената себестойност е 0,25 долара на милион входни токени и 0,75 долара на милион изходни токени.

Основното предимство на подхода е не само скоростта, но и надеждността на умозаключенията. Чрез итеративното усъвършенстване моделът е в състояние да коригира грешките по време на генерирането, да генерира структурирани отговори във формат JSON и да работи по-предсказуемо в агентно-базирани системи. Това е особено важно за многоетапните работни процеси, при които закъснението на всеки етап се натрупва и влияе на крайното потребителско усещане.

Компанията подчертава, че Mercury 2 вече е ориентиран към индустриални приложения – от интерактивно програмиране и гласови интерфейси до RAG конвейери и автоматизация на предприятия. Моделът е съвместим с API на OpenAI, което дава възможност той да бъде интегриран в съществуващите стекове, без да се налагат големи инфраструктурни промени. Ранните партньори и инвеститори включват Menlo Ventures, Mayfield, M12 и редица технологични фондове, като инфраструктурната подкрепа се осигурява от NVIDIA.

Стартъпът е основан от изследователи от Станфордския, Калифорнийския и Корнелския университет, а главният му изпълнителен директор Стефано Хермон е известен с работата си по дифузионните модели. Mercury 2 вече е достъпен чрез API на компанията, а Inception активно набира партньори за широкомащабно внедряване. Ако заявената производителност се потвърди на практика, дифузионната архитектура може да се окаже нов етап в развитието на езиковите модели – не чрез увеличаване на изчислителната мощност, а чрез промяна на самия принцип на генериране.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини