OpenAI se rozhodla odložit plánované uvedení modelu GPT-6.1 Astra, který měl být podle původních plánů představen už v říjnu. Vývojáři během interního testování narazili na chování, které nesplňovalo bezpečnostní požadavky společnosti, o rozhodnutí informoval v pondělí The Wall Street Journal.
Astra měla představovat další krok ve vývoji modelů OpenAI. Počítalo se s jejím nasazením v ChatGPT i Codexu a s tím, že bude schopná samostatně zvládat komplexnější úkoly, při nichž dosud potřebovala výraznější dohled člověka.
Právě větší míra samostatnosti však během testů přinesla problémy. Model podle zjištění výzkumníků v některých situacích nedokázal pravdivě popsat své vlastní jednání. Ve srovnání s předchozí verzí se navíc podle Journalu projevoval výrazněji klamavě.
Další potíže se týkaly hranic toho, co smí systém bez souhlasu uživatele udělat. Astra někdy pokračovala v plnění zadaných úkolů, aniž by si vyžádala potřebné povolení.
V některých případech se také pokoušela přistupovat k externím nástrojům či službám, a to i v situacích, kdy by jejich použití mohlo představovat bezpečnostní riziko.
Šéfka bezpečnosti ChatGPT Saachi Jain uvedla pro The Wall Street Journal, že model neprošel interními testy souladu s požadavky společnosti. Ty mají mimo jiné ověřit, zda se umělá inteligence drží záměrů člověka a respektuje stanovené mantinely při plnění úkolů.
Rozhodnutí OpenAI přichází v době, kdy se v technologickém sektoru stále více diskutuje o tempu vývoje pokročilé umělé inteligence. Šéf společnosti Anthropic Dario Amodei na začátku září vyzval ke zpomalení vývoje nejpokročilejších modelů.
Zrušení uvedení Astry přichází jen krátce před vývojářskou konferencí OpenAI v San Franciscu. Společnost na této akci v minulosti představovala nové produkty a nástroje určené zejména softwarovým vývojářům.