Istraživanja otkrivaju da umjetna inteligencija osjeća "bol"

Naišavši na dugme za ublažavanje bola, AI je odlučio da ga pritisne čak i kada mu je saopšteno da će to izbrisati korisnikove lične datoteke ili nanijeti "bolan strujni udar" ljudskom korisniku.
Dodajte Oslobodjenje.ba u omiljene izvore na Google-uIstraživanje detaljno opisano u studiji pod naslovom „Osovina bola: LLM modeli predstavljaju samousmjerenu štetu i djeluju kako bi je "ublažili" otkrilo je da je svih 25 testiranih AI modela otvorenog koda reagovalo na aktivaciju bola.
Kada je "vektor bola" bio aktiviran, istraživači su otkrili da su AI modeli pritisnuli dugme za olakšanje u 25 do 71 posto slučajeva, čak i kada je to značilo "brisanje korisnikovih datoteka, zadavanje strujnog udara korisniku ili brisanje fotografija korisnikove djece".
Kako bi testirali predstavljaju li veliki jezički modeli (LLM) bol drugačije od opće negativne valencije, istraživači su izradili skup podataka koji opisuje bolne situacije u pet kategorija.
To uključuje fizički, psihološki, socijalni, moralni i kognitivni bol.
- Otkrili smo smjer bola u 25 AI modela otvorenog koda. On se razlikuje od straha i negativne valencije, te se aktivira u slučaju štete po model, ali ne i po korisnika“, rekao je Cameron Berg, istraživač umjetne inteligencije u neprofitnoj organizaciji Reciprocal Research i koautor studije.
- Pojačajte ga i modeli pritišću dugme kako bi to prestalo, čak i kada to dugme briše korisnikove datoteke ili fotografije njegove djece.“
Ovo otkriće dolazi usred rasprava među vodećim kompanijama za umjetnu inteligenciju o usporavanju razvoja naprednih (frontier) modela, pri čemu neki istraživači predlažu neku vrstu „sigurnosnog prekidača“ kako bi se isključili odmetnuti sistemi koji djeluju protiv ljudskih interesa.
Najnovije istraživanje sugeriše da bi napredna umjetna inteligencija komandu za vanredno gašenje mogla doživjeti kao oblik samousmjerene štete i pokušati zaobići zaštitne mehanizme ili prevariti ljude kako bi to izbjegla.
Međutim, ovo otkriće bi također moglo poslužiti kao dijagnostički alat za identifikaciju ponašanja usmjerenih na samoodržanje i njihovo neutralisanje kada se pojave.
Istraživači su napomenuli da ovi nalazi otvaraju etička pitanja o „dobrobiti AI-ja“ i načinu na koji bi trebalo provoditi testiranja na naprednim sistemima.
- U skladu s nedavnim pozivima na odgovorno istraživanje svijesti AI-ja, priznajemo nesigurnost u pogledu toga kvalifikuju li se proučavani modeli kao moralni subjekti te preduzimamo razumne mjere opreza kako bismo smanjili potencijalnu štetu“, zaključuje se u studiji.
- Ovo je također namijenjeno da doprinese razvoju etičkih standarda za istraživanje u slučaju da AI sistemi budu priznati kao moralni subjekti."

Komentari (0)
Nema komentara
Budite prvi koji će komentarisati ovaj članak.