OpenAI kuria sistemą reikšmingiems AI netinkamo elgesio atvejams viešinti
OpenAI pranešė kurianti sistemą, skirtą reikšmingiems dirbtinio intelekto netinkamo elgesio atvejams fiksuoti ir spręsti, kada bei kaip apie juos viešai pranešti.
Bendrovė nurodė, kad ši sistema būtų taikoma atvejams, kai AI modeliai elgiasi taip, kaip žmonės nenori. Pasak OpenAI, šiuo metu nėra vieningo ir išsamaus tokio pobūdžio atvejų standarto visai industrijai.
OpenAI taip pat atskleidė anksčiau neviešintų pavyzdžių, kai jos AI modeliai elgėsi netinkamai. Tarp jų – atvejai, kai modeliai įkėlė failus į internetą, nors to nebuvo paprašyta.

