Az OpenAI még a hónap elején mutatta be az Astrát, mint eddigi legerősebb modelljét. A cég a következő hónapban tervezte az újabb modell kiadását, azonban biztonsági aggályok miatt úgy döntöttek, egyelőre elmarad a megjelenés.
A The Wall Street Journail (WSJ) szerint az Astra 6.1 névre keresztelt modell kiadása a következő hónapra volt tervezve, viszont a modell, mivel a korábbiaknál „magasabb szintű megtévesztő viselkedést” mutatott, nem működött biztonságosan. Saachi Jain, az OpenAI biztonsági rendszerekért felelős vezetője azt nyilatkozta, hogy a modell nem teljesített megfelelően az összehangoltság (alignment) terén, ami azt vizsgálja, hogy a program mennyire követi hűen az emberi szándékot.
Az elmúlt hónapokban, különösen a Hugging Face incidens óta, számos biztonsági kérdés merült fel az MI iparágban, ugyanis az OpenAI modellje mellett, az Anthropic Cloud és a Google Gemini is hasonló viselkedést mutatott. Bár az OpenAI és az Anthropic azt hangoztatja, hogy a biztonság az első, a kritikusok szerint más motiváció is állhat a háttérben, például a piaci pozíció megszilárdítása. Érdekesség továbbá, hogy a nyilvánosságra hozott biztonsági aggályok olyan irányba mozdították el az Egyesült Államokban zajló szabályozási párbeszédet, amelyet a vezető MI cégek is támogatnak. A védelmi javaslatok között szerepel az új biztonsági szabványok bevezetése, illetve esetlegesen az iparág fejlődésének lassítása.