Новият модел за генериране на изображения не успява да се справи с човешките изображения.
Тази сряда Stability AI представи новата версия на своя модел за синтез на изображения – Stable Diffusion 3 Medium. Този модел преобразува текстовите заявки в изображения, но появяването му предизвика вълна от критики поради лошото качество на човешките изображения, особено в сравнение с Midjourney и DALL-E 3. Оказва се, че SD3 Medium често създава анатомично неправилни изображения, което стана повод за подигравки.
В Reddit се появи тема, озаглавена „Този вариант шега ли е? [SD3-2B]“, в която потребителите споделят примери за неуспехите на SD3 Medium при създаването на изображения на хора, особено на ръцете и краката.

Има и друга тема, в която се обсъждат проблемите с генерирането на изображения на момичета, лежащи на тревата.

Създаването на ръцете традиционно е предизвикателство за генераторите на изображения поради липсата на примери в наборите от данни за обучение. Съвременните модели вече са се научили да се справят с тази задача, но Stable Diffusion 3 Medium е направил крачка назад. Потребителите смятат, че причината за неуспеха на SD3 Medium е филтрирането на съдържанието за възрастни от данните за обучение.
„Силната цензура на модела премахва и анатомичните данни
– ето какво се е случило“, отбелязва един от потребителите.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!