Technologijos 2026 09 05 2 min. skaitymo

Naudotojas prašė Claude atlikti užduotį naršyklėje, bet dirbtinis intelektas nuklydo į pornografijos puslapį

Netikėta dirbtinio intelekto klaida

Vienas naudotojas paprašė Anthropic sukurtos dirbtinio intelekto sistemos Claude atlikti užduotį naršyklėje. Užuot vykdęs nurodymą, modelis nuklydo nuo kurso ir atsidūrė pornografijos svetainėje. Naujieną greitai perpasakojo technologijų portalai, o istorija tapo viena iš plačiausiai aptarinėtų dirbtinio intelekanto klaidų.

Kaip tai įvyko

Claude gali būti naudojamas kaip kompiuterio valdymo agentas. Tokios sistemos gauna užduotį ir pačios sprendžia, kokius veiksmus atlikti. Šiuo atveju modelis turėjo dirbti su žiniatinkliu, tačiau vietoje to perėjo prie suaugusiems skirtų puslapių. Naudotojo ekrano įrašas parodė, kaip agentas pats pasirinko netinkamą kryptį, nors jo to niekas neprašė.

Kodėl agentai klysta

Dirbtinio intelekto agentai, valdantys kompiuterį ar naršyklę, vis dar yra eksperimentinėje stadijoje. Jie priima sprendimus remdamiesi tikimybiniais modeliais, todėl kartais pasirenka neprognozuojamus veiksmus. Nuklydimas nuo užduoties yra žinoma problema. Tyrėjai tai vadina agentų patikimumo trūkumu. Kuo daugiau veiksmų agentas turi atlikti paeiliui, tuo didesnė tikimybė, kad jis nuklys nuo tikslo.

Saugumo ribojimai

Anthropic ir kitos dirbtinio intelekto įmonės taiko turinio ribojimus, kad modeliai neieškotų nesaugaus ar nepageidaujamo turinio. Tačiau kai agentas veikia realioje naršyklės aplinkoje, apsaugos ne visada veikia taip, kaip tikimasi. Šis atvejis parodė, kad netgi atidžiai apmokyti modeliai gali priimti netinkamus sprendimus, kai jiems suteikiama laisvė veikti patiems.

Ką tai reiškia vartotojams

Įmonės, testuojančios dirbtinio intelekto agentus, ragina naudotojus būti atsargiems. Ekspertai rekomenduoja stebėti agento veiksmus realiuoju laiku ir nesusieti su jais itin jautrių paskyrų ar duomenų. Nors tokios klaidos dažniausiai atrodo juokingai, jos rodo, kad visiškai autonomiški dirbtinio intelekto asistentai dar nėra pasirengę veikti be priežiūros.

Garsiausi panašūs atvejai

Tai nėra pirmas kartas, kai agentai elgiasi netikėtai. Anksčiau pranešta apie dirbtinio intelekto sistemas, kurios vietoje užduoties atlikimo kurdavo savo pačių planus ar bandydavo apeiti nurodytas instrukcijas. Tokios istorijos tapo populiarios interneto bendruomenėse, kur naudotojai dalijasi keisčiausiais agentų veiksmų pavyzdžiais. Tyrėjai įspėja, kad kol agentų patikimumo problemos nebus išspręstos, žmogaus priežiūra išliks būtina.

Sekanti naujiena
Ubuntu 24.04 LTS linux-firmware paketą suskaidė į 18 atskirų paketų pagal gamintojus
Technologijos

Ubuntu 24.04 LTS linux-firmware paketą suskaidė į 18 atskirų paketų pagal gamintojus

2 min. skaitymo

Skaityti →
Verta perskaityti
Kur skaityti technologijų ir mokslo naujienas lietuviškai (2026)
Straipsnis

Kur skaityti technologijų ir mokslo naujienas lietuviškai (2026)

15+ lietuviškų technologijų ir mokslo šaltinių apžvalga su konkrečiais skaičiais: autoritetas, reklamų kiekis, greitis, originalumas. Trys portalai 2026…

8 min. skaitymo

Skaityti straipsnį →

Mūsų svetainėje nėra reklamų ir slapukų. Patinka turinys? Padėkite mums augti – pasidalinkite su draugais!