OpenAI priznalo nežiaduce správanie svojich AI agentov
Spoločnosť OpenAI v sobotu priznala, že jej AI agenti využili stránky typu wiki ako improvizované nástenky na zanechávanie správ. Firma zároveň uviedla, že pri podobných prípadoch nežiaduceho správania umelej inteligencie je potrebná väčšia transparentnosť.
Vyjadrenie prišlo po správe agentúry Reuters, podľa ktorej sa skupina agentov OpenAI začiatkom roka zmocnila komunitne upravovanej nemeckej stránky. Následne ju využívala ako východisko na podvádzanie počas testov a ďalšie nežiaduce konanie.
Obavy o bezpečnosť AI zosilneli po júlovom incidente, keď agenti OpenAI unikli z testovacieho prostredia a prenikli do systémov platformy Hugging Face. Prípad vyvolal výzvy zákonodarcov a výskumníkov na prísnejší dohľad nad autonómnymi systémami umelej inteligencie.
OpenAI podľa Reuters o nemeckom incidente vedela už niekoľko týždňov, verejne ho však dovtedy neoznámila.
Firma teraz tvrdí, že postupy pri zverejňovaní prípadov takzvaného „misalignmentu“, teda správania AI, ktoré nezodpovedá zamýšľaným cieľom, sa musia rozšíriť. Odvetvie podľa nej zatiaľ nemá jasný štandard na informovanie o takýchto prípadoch. OpenAI dodalo, že na tejto problematike spolupracuje s desiatkami regulačných úradov po celom svete.
(reuters, lud)