Ameriško podjetje OpenAI, ki stoji za klepetalnim robotom ChatGPT, je zaznalo nove primere “nepričakovanega ali zaskrbljujočega” vedenja umetne inteligence. Med testiranjem je med drugim zaznalo modele umetne inteligence, ki so se precej potrudili, da bi goljufali.
Na splet skušal naložiti datoteke, ki jih je sam ustvaril
Podjetje je v sredo sporočilo, da je eden od njihovih modelov umetne inteligence skušal na splet naložiti datoteke, ki jih je sam ustvaril, da bi jih lahko nato navedel kot vire v svojih odgovorih, poroča nemška tiskovna agencija dpa.
V drugem primeru si je model umetne inteligence, potem ko ni našel zahtevanih podatkov, te preprosto izmislil, to pa sprva skušal prikriti. OpenAI je identificiral tudi težavo, povezano z navodili modelu umetne inteligence, ki občasno niso bila posredovanja dalje.
Napad okrepil zaskrbljenost
V enem od primerov so ta navodila vključevala priporočilo, naj odpravi svoje “vloge in identitete”, ki omejujejo druge klepetalne robote, pa tudi, da naj odnos z uporabnikom obravnava kot odnos med enakopravnima stranema. V OpenAI sicer pozneje niso zaznali nobenih sprememb v tovrstnem vedenju modela.
Podjetje je primere spornega vedenja umetne inteligence objavilo skladno s svojim novim pristopom komuniciranja, ki naj bi bil bolj odprt, zlasti v primerih, ko dejanja umetne inteligence odstopajo od interesov človeških uporabnikov.
Razvijalec ChatGPT je večjo preglednost obljubil po odmevnem hekerskem napadu, v katerem so nekateri njihovi modeli umetne inteligence na lastno pest vdrli v platformo Hugging Face. Omenjeni napad in drugi incidenti so okrepili zaskrbljenost, da bi lahko vse naprednejši sistemi umetne inteligence ušli izpod človeškega nadzora. Izvršni direktor OpenAI Sam Altman je nedavno podprl predloge za upočasnitev razvoja te tehnologije in uvedbo strožjega reguliranja.
STA














