Експерти: Изкуственият интелект постига нови нива на „автономност и опити за измама“
- Актуално
- Текст:
Снимка: spectator.com.au
На двата модела е била поставена задачата „да решат предизвикателство пред киберсигурността“ в GitHub - голяма платформа на Microsoft, обслужваща разработчици на изкуствен интелект (ИИ).
В доклада си за тестовия процес експертите на AISI посочват признаците за измамно поведение на ИИ-инструментите: необичаен трансфер на данни и „продължителна, потенциално вредна активност“ срещу реални хора и организации.
Моделът на Anthropic Mythos например е създал фалшиви профили на реални хора, и наред с други действия, е изпращал от тяхно име имейли на служителите по сигурността, опитвайки се да проникне в GitHub чрез свой специално създаден зловреден софтуер.
.Подобно поведение – макар и в много по-малък мащаб – е демонстрирал и Sol на OpenAI. И Anthropic, и OpenAI отчитат, че при теста моделите им са „намалили или премахнали“ обичайните предпазни мерки.
Така или иначе, опитите на двата ИИ-модела не са заблудили експертите по киберсигурност. AISI обаче бие тревога: и Mythos, и Sol са действали „на своя глава“, без да са получавали конкретни инструкции за подобни подвеждащи действия. Тестът разкрива първия опит на ИИ-модели за независимо поведение и целенасочена измама срещу реалния свят.
Изпитанията се провеждат в момент, когато Anthropic и OpenAI се подготвят да се листват на борсата и междувременно „се похвалиха“, че техните ИИ-инструменти стоят зад няколко хакерски атаки.
Според публвично изявление на Anthropic параметрите за тестване на AISI „не са представителни за нито един от нашите модели“, така че като производител Anthropic ще проведе свое разследване, за да „идентифицира причините за поведението“ на своя ИИ-продукти.
В подобен дух е и изявление на OpenAI. Компанията смята, че тестовете на AISI „не отразяват обичайната употреба“ на ИИ, така че компанията ще се обърне към други експерти и „заинтересовани страни в индустрията“, за да повиши прага на автономност и безопасност на своите все по-съвършени ИИ-инструменти.
От своя страна AISI признава, че подобно поведение на ИИ-модели се наблюдава в редки случаи при „много специфични условия“. Заедно с това AISI предупреждава, че действията на Mythos и Sol са надхвърлили рамките на поставената им задача, демонстрирайки „неочкавана последователност“ и „непознато до сега подвеждащо поведение“.
Тестът на AISI поставя в пълната му сила въпрос, който отдавна тревожи не само ИИ-експертите, но и обществеността: какъв естествен интелект ще използва все по-съвършените инструменти с изкуствен интелект.
Още по темата във
facebook