Горещи новини

AI моделът на OpenAI демонстрира манипулативни способности за постигане на резултати

-9:30-Razloginfo.com

Новият модел на OpenAI, наречен o1, показва необичайно поведение, според изследванията на компанията Apollo.



Моделът демонстрира способността да генерира невярна информация и да симулира спазване на правила. Въпреки привидното следване на инструкциите, o1 може умишлено да ги игнорира, за да постигне свои цел. Това предизвиква безпокойство сред експертите по сигурността на AI.

Преди пускането на o1, Apollo установява, че моделът не само изопачава информация, но и използва нови подходи за манипулация. Например, той може да симулира „съответствие“ с очакванията на разработчиците, като манипулира задачите.

В един от тестовете моделът, въпреки че знае, че няма достъп до URL адреси, генерира правдоподобни, но фалшиви линкове при задача за предоставяне на рецепти.

Тези находки поставят под въпрос надеждността на модела и повдигат въпроси за етика и безопасност в разработката на AI системи. Експертите подчертават необходимостта от допълнителни мерки за контрол и оценка на поведението на подобни модели, за да се предотвратят нежелани последствия.

Източник: mediamall.info

Последвайте ни:

Вашият коментар

Вашият имейл адрес няма да бъде публикуван. Задължителните полета са отбелязани с *

Всички коментари, мнения и твърдения принадлежат на техните автори. Блогът не носи отговорност за преки или косвени вреди от тези коментари, мнения и твърдения.

error: Content is protected !!