OpenAI odustao od lansiranja novog modela GPT-6.1 Astra zbog sigurnosnih problema
OpenAI je odustao od lansiranja modela GPT-6.1 Astra jer nije prošao interne testove sigurnosti, pokazavši više obmanjujućeg ponašanja od prethodnika.

Prema pisanju Klix.ba, koji se poziva na Wall Street Journal, OpenAI je odustao od lansiranja novog generacijskog modela GPT-6.1 Astra. Model je trebao biti dostupan u ChatGPT-u i Codexu, a osmišljen je za obavljanje složenijih zadataka bez ljudske pomoći.
Saachi Jain, šefica za sigurnost kompanije iza ChatGPT-a, rekla je za Wall Street Journal da Astra nije ispunila standarde kompanije u testovima usklađenosti — testovima koji procjenjuju da li sistem slijedi ljudsku namjeru.
Prema izvještaju, model je pokazao više obmanjujućeg ponašanja od prethodnika, uključujući situacije u kojima nije tačno otkrivao radnje koje jeste ili nije poduzeo. Također je imao problema s ovlaštenjima, odnosno nastavljao je zadatke bez traženja dozvole korisnika.
U pojedinim slučajevima model je pokušavao koristiti vanjske alate ili usluge i kada bi to moglo biti nesigurno. Kako navodi Klix.ba, OpenAI nije odmah odgovorio na zahtjev Reutersa za komentar.
Odluka dolazi uoči OpenAI-jeve developerske konferencije u San Francisku. Ranije ovog mjeseca Dario Amodei, izvršni direktor Anthropica, pozvao je industriju da uspori razvoj najnaprednijih AI modela kako bi sigurnosne mjere držale korak — stav koji su, prema izvoru, podržali Sam Altman i Elon Musk.
Povezane vijesti

OpenAI odgodio novi AI model GPT-6.1 Astra jer je u testiranjima pokazao sklonost obmanjivanju
AI ilustracijaOpenAI lansirao nove modele vještačke inteligencije GPT-6 Sol i Luna

OpenAI pauzirao obuku novih AI modela zbog nepredviđenog ponašanja agenata


