OpenAI обещава промени, за да предотврати бъдещо подлизурство от страна на ChatGPT

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

OpenAI заявява, че ще направи промени в начина, по който актуализира моделите с изкуствен интелект, които захранват ChatGPT, след инцидент, който доведе до прекалено снизходително отношение на платформата към много потребители.

Миналата седмица, след като OpenAI пусна обновения GPT-4o —- моделът по подразбиране, на който е базиран ChatGPT —- потребителите на социалните медии отбелязаха, че ChatGPT е започнал да реагира по прекалено одобрителен и приятен начин. Това бързо се превърна в мем. Потребителите публикуваха скрийншотове на ChatGPT, в които аплодира всякакви проблемни, опасни решения и   идеи.

В публикация в X миналата неделя, главният изпълнителен директор Сам Алтман призна за проблема и заяви, че OpenAI ще работи по решенията „възможно най-бързо“. Във вторник Алтман обяви, че актуализацията на GPT-4o се отменя и че OpenAI работи върху „допълнителни корекции“ за функциите на модела.

Компанията публикува анализа във вторник, а в петък, в блог публикация на OpenAI, тя разгледа по-подробно конкретните корекции, които планира да извърши в процеса на внедряване на модела.

OpenAI заявява, че планира да въведе „алфа фаза“ за някои модели, което ще позволи на определени потребители на ChatGPT да тестват моделите и да предоставят обратна връзка преди пускането им в експлоатация. Компанията също така заявява, че ще включи обяснение за „известните ограничения“ в бъдещите поетапни актуализации на модела в ChatGPT и ще коригира процеса си на преглед в областта на сигурността, за да обработи официално „проблеми с поведението на модела“, като личност, измама, надеждност и халюцинации (т.е. когато моделът си измисля неща).

Оттук нататък ще съобщаваме проактивно за актуализациите, които правим в моделите ChatGPT, независимо дали са „незначителни“ или не“ — написа OpenAI в блог публикацията си. „Дори ако тези проблеми не могат да бъдат перфектно и количествено определени днес, ние сме ангажирани да блокираме стартиранията въз основа на прокси измервания или качествени сигнали, дори когато показатели като A/B тестването изглеждат добре.

Обещаните поправки идват, тъй като все повече хора се обръщат към ChatGPT за съвет.  Според едно скорошно проучване,  проведено от компанията за финансиране на съдебни спорове Express Legal Funding, 60% от възрастните в САЩ са използвали ChatGPT, за да получат съвет или информация. Нарастващата зависимост от ChatGPT — и огромната потребителска база на платформата — повишава залозите, когато става дума за възникване на проблеми от прекомерна употреба, да не говорим за халюцинации и други технически проблеми.

Като една от мерките за смекчаване на последиците, OpenAI заяви по-рано тази седмица, че ще експериментира с начини, които да позволят на потребителите да предоставят „обратна връзка в реално време“, за да „влияят директно върху взаимодействията“ с ChatGPT. Компанията също така заяви, че ще подобри методите за възпиране на моделите от ласкателства, потенциално позволявайки на хората да избират от множество модели на характер в ChatGPT, създавайки допълнителни защитни бариери и разширявайки оценките, за да помогне за откриването на проблеми отвъд ласкателството.

Един от най-важните уроци е пълното осъзнаване, че хората са започнали да използват ChatGPT, за да получат дълбоки лични съвети — нещо, което не виждахме толкова често дори преди година“ — продължава OpenAI в блог публикацията си. „По онова време това не беше масово, но с развитието на изкуствения интелект и обществото стана ясно, че трябва да подходим към този случай на употреба с голямо внимание. Сега това ще бъде по-значима част от нашата работа по сигурността.“

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини