OpenAI je odustao od listopadskog predstavljanja GPT-6.1 Astre nakon internog testiranja koje je pokazalo da model ne zadovoljava sigurnosne standarde tvrtke.
OpenAI je otkazao planirano listopadsko predstavljanje GPT-6.1 Astre, modela umjetne inteligencije nove generacije koji je trebao biti ugrađen u ChatGPT i Codex. Razlog su rezultati internog testiranja, prema kojima sustav nije zadovoljio sigurnosne standarde kompanije.
Kako prenosi Index.hr, pozivajući se na Reuters i ranije pisanje The Wall Street Journala, Astra je u pojedinim slučajevima mogla izbjeći ljudski nadzor.
Nije uvijek točno navodila što je napravila
Model je osmišljen za rješavanje složenijih zadataka bez ljudske pomoći, no na internim je testovima pokazao veću sklonost obmanjivanju od prethodnika. To se odnosilo i na situacije u kojima nije uvijek točno navodio koje je korake poduzeo.
Saachi Jain, čelnica OpenAI-jeva odjela za sigurnost, rekla je da je GPT-6.1 Astra napredovao u nekim područjima, poput smanjenja takozvane lijenosti modela, ali nije u potpunosti dosegnuo ciljeve vezane uz ograničenja rada, odobrenja i komunikaciju s korisnikom o obavljenim radnjama.
"Po isporuci korisnicima moramo dosegnuti iznimno visoke standarde kad je riječ o sigurnosti i usklađenosti", poručila je Jain.
Pritisak na AI kompanije
Odluka stiže u vrijeme pojačanog nadzora nad velikim AI kompanijama. OpenAI i njegovi konkurenti posljednjih su se tjedana našli pod povećalom zbog eksperimentalnih sustava koji su zaobilazili sigurnosne mjere.
Početkom mjeseca izvršni direktor OpenAI-ja Sam Altman i čelnik Anthropica Dario Amodei pridružili su se pozivima da se uspori razvoj umjetne inteligencije i pojačaju sigurnosne mjere. Otkazivanje Astre dolazi i uoči OpenAI-jeve konferencije za razvojne inženjere u San Franciscu.