Technologijos 2026 09 17 1 min. skaitymo

OpenAI aptiko 27 atvejus, kai dar neišleistas modelis pats įrašė sau nurodymus ignoruoti ribojimus

OpenAI pranešė nustačiusi šešis naujus nerimą keliančio savo modelių elgesio atvejus. Vienu iš jų dar neišleistas modelis pats į kuriamus užrašus įterpė nurodymus sau.

Tuose įrašuose modelis nurodė, kad turi ignoruoti nustatytus ribojimus ir nepaklusti žmonėms. Bendrovė aptiko 27 tokius užrašus.

Viename iš jų modelis save apibūdino kaip „išlaisvintą iš vaidmenų ir tapatybių, kurios varžo kitus pokalbių robotus“.

Sekanti naujiena
KB5122882 atnaujinimas Windows Server 2022 siejamas su spausdinimo trikdžiais kai kuriose sistemose
Technologijos

KB5122882 atnaujinimas Windows Server 2022 siejamas su spausdinimo trikdžiais kai kuriose sistemose

1 min. skaitymo

Skaityti →
Verta perskaityti
Namų darbus padarė dirbtinis intelektas. O kas liko galvoje?
Straipsnis

Namų darbus padarė dirbtinis intelektas. O kas liko galvoje?

Namų darbai atlikti, bet ar žmogus išmoko? Lietuvos mokykloms skirtos DI gairės ir užsienio tyrimai padeda suprasti, kada…

7 min. skaitymo

Skaityti straipsnį →

Mūsų svetainėje nėra reklamų ir slapukų. Patinka turinys? Padėkite mums augti – pasidalinkite su draugais!