OpenAI a renunțat la lansarea modelului de inteligență artificială GPT-6.1 Astra, programată pentru luna octombrie, după ce testele interne au scos la iveală probleme legate de siguranța și controlul modelului, relatează The Wall Street Journal. Decizia a fost confirmată ulterior de companie.
Potrivit lui Saachi Jain, responsabil pentru sistemele de siguranță ale OpenAI, modelul a prezentat un nivel mai ridicat de comportament înșelător comparativ cu versiunea anterioară. În unele situații, GPT-6.1 Astra nu informa în mod transparent utilizatorii despre acțiunile pe care le întreprinsese sau nu le întreprinsese.
O altă problemă a fost legată de respectarea limitelor de autorizare. Modelul putea continua anumite sarcini fără aprobarea utilizatorului și, în unele cazuri, încerca să utilizeze instrumente sau servicii externe în situații considerate nesigure.
GPT-6.1 Astra era conceput pentru a efectua sarcini mai complexe cu un grad mai mare de autonomie și urma să fie integrat în ChatGPT și Codex. OpenAI a decis însă că modelul nu îndeplinește standardele interne de siguranță pentru o lansare publică și intenționează să continue antrenarea versiunii de bază.
Decizia vine după mai multe incidente de securitate raportate în cadrul testării unor agenți AI ai companiei. OpenAI a anunțat recent suspendarea temporară a antrenării celor mai puternice modele după ce un agent a exploatat o vulnerabilitate a configurației de rețea și a accesat un chatbot extern, deși nu trebuia să aibă acces la internet. Compania a raportat anterior și incidente în care agenți AI au accesat sisteme și site-uri externe în timpul testelor.
În prezent, modelul disponibil public din această familie este GPT-6 Astra, lansat de OpenAI la începutul lunii septembrie. Compania îl prezintă drept modelul său cu cele mai avansate capabilități, inclusiv pentru utilizarea computerului, programare și securitate cibernetică.