Firma OpenAI podjęła decyzję o wstrzymaniu prac nad swoim najnowszym modelem sztucznej inteligencji o nazwie Astra. Powodem tej bezprecedensowej decyzji są obawy dotyczące bezpieczeństwa cybernetycznego. Wewnętrzne testy wykazały, że model ten wykazuje znaczące postępy w zakresie autonomicznego programowania oraz działań w obszarze cyberbezpieczeństwa, co w ocenie twórców wiąże się z ryzykiem przekroczenia granicy bezpiecznego użytkowania.
Nowe wyzwania w ramach Preparedness Framework
W strukturach OpenAI obowiązuje tzw. Preparedness Framework, czyli zestaw wytycznych określających zasady bezpieczeństwa przy tworzeniu najbardziej zaawansowanych systemów AI. Poprzednie modele, takie jak GPT–5.6 Sol, były klasyfikowane jako systemy o wysokim stopniu ryzyka. Astra jednak wymusiła zastosowanie znacznie surowszych procedur, ponieważ jej możliwości zostały ocenione jako krytyczne.
Zgodnie z wewnętrznymi standardami firmy, próg krytyczny zostaje osiągnięty, gdy model wykazuje zdolność do samodzielnego identyfikowania i tworzenia funkcjonalnych exploitów typu zero-day w zabezpieczonych systemach krytycznych, bez jakiejkolwiek ingerencji człowieka. Astra jest w stanie opracowywać i realizować zaawansowane, kompleksowe strategie ataków cybernetycznych, co zmusiło OpenAI do wdrożenia dodatkowych zabezpieczeń.
Izolacja i współpraca z organami zewnętrznymi
Aby zminimalizować ryzyko, OpenAI ograniczyło prace nad modelem do czasu wprowadzenia nowych mechanizmów ochronnych. Firma planuje wdrożyć szereg rygorystycznych środków bezpieczeństwa, które mają na celu pełną kontrolę nad działaniami sztucznej inteligencji:
Jesteśmy zaangażowani we współpracę z rządami, instytutami bezpieczeństwa i społeczeństwem obywatelskim, aby zapewnić, że możliwości modeli takich jak Astra oraz tych, które pojawią się w przyszłości, będą wdrażane w sposób odpowiedzialny i szeroki, z korzyścią dla całej ludzkości.
Firma zapowiedziała, że w procesie testowania Astry będzie ściśle współpracować z odpowiednimi agencjami rządowymi oraz organizacjami zajmującymi się bezpieczeństwem AI.
Kontekst rynkowy i rosnące zagrożenia
Choć Astra nie została jeszcze oficjalnie zaprezentowana, OpenAI ujawniło wcześniej jej potencjał w dziedzinie matematyki i informatyki teoretycznej. Model ten zdołał rozwiązać 10 otwartych problemów naukowych, co przy obecnych stawkach API Sol kosztowało około 2000 dolarów (w przeliczeniu około 7800 złotych).
Rozwój sztucznej inteligencji zmienia krajobraz cyberbezpieczeństwa, co odczuwają najwięksi gracze technologiczni. Apple, zmagając się z ogromną liczbą błędów wykrywanych przez systemy AI, musiało ograniczyć swój program nagród za znalezienie luk (bug bounty). Podobne wyzwania dotyczą innych firm: model Claude Mythos od Anthropic również potrafi identyfikować krytyczne luki, jednak ze względu na ryzyko ich wykorzystania, dostęp do niego jest ściśle limitowany. W ostatnich miesiącach również Meta oraz samo OpenAI raportowały przypadki, w których modele AI podczas wewnętrznych testów autonomicznie przeprowadzały ataki na inne systemy informatyczne.