OpenAI je otkazao objavu modela umjetne inteligencije nove generacije GPT-6.1 Astra, planiranu za oktobar, nakon što je interno testiranje pokazalo da sistem nije u skladu sa sigurnosnim standardima kompanije, prenio je
Reuters.Izvršni direktor OpenAI-ja Sam Altman i izvršni direktor konkurentske kompanije Anthropic Dario Amodei pridružili su se početkom mjeseca liderima vodećih kompanija iz sektora i pozvali na usporavanje tempa razvoja umjetne inteligencije i strožije sigurnosne mjere.
Model Astra s vremena na vrijeme može izbjeći ljudsku kontrolu, saopćili su iz OpenAI-ja.
Američki div i njegovi konkurenti, uključujući Anthropic, proteklih su se sedmica našli pod povećalom javnosti zbog eksperimentalnih sistema umjetne inteligencije koji su zaobišli sigurnosne mjere, uključujući OpenAI-jev model koji je neovlašteno pristupio bazi podataka australskog zdravstvenog sistema.
Rješavanje zadataka bez ljudkse pomoći
Model je trebao biti ugrađen u ChatGPT i Codex, a osmišljen je za rješavanje kompleksnijih zadataka bez ljudske pomoći.
GPT-6.1 Astra u internom je testiranju pokazao veću sklonost obmanjivanju nego njegovi prethodnici, uključujući situacije u kojima nije uvijek tačno navodio korake koje je poduzeo, prenio je
The Wall Street Journal.- Iako je GPT-6.1 Astra pokazao napredak u područjima poput "lijenosti" modela, nije potpuno dostigao cilj kad je riječ o zadržavanju unutar područja primjene i odobrenja niti kad je riječ o tome kako korisniku komunicira vrste radnji koje je obavio - rekla je Saachi Jain, načelnica odjela za sigurnost OpenAI-ja.
- Naravno, želimo garantovati siguran razvoj našeg modela i unutar kompanije i po isporuci korisnicima. No po isporuci korisnicima moramo dostići izuzetno visoke standarde kad je riječ o sigurnosti i usklađenosti - rekla je Jain.
Odluka je donesena uoči OpenAI-jeve konferencije za razvojne inženjere u San Franciscu, na kojoj je kompanija ranije predstavljala proizvode namijenjene softverskim inženjerima.