ApplePlanet.PL
  • REDAKCJA
  • WSPÓŁPRACA
  • POLITYKA PRYWATNOŚCI
No Result
View All Result
  • Apple
  • Nauka i technika
  • Sztuczna inteligencja AI
  • Security
  • Gry
  • Smartfony
  • Komputery & Tablety
  • Lora
poniedziałek, 27 lipca, 2026
  • Apple
  • Nauka i technika
  • Sztuczna inteligencja AI
  • Security
  • Gry
  • Smartfony
  • Komputery & Tablety
  • Lora
No Result
View All Result
ApplePlanet.PL
No Result
View All Result
Home Security

Większość modeli sztucznej inteligencji nie radzi sobie z wykrywaniem złośliwego oprogramowania do sabotażu nuklearnego

od Redakcja ApplePlanet
27 lipca, 2026
w Security
0
Analityk bezpieczeństwa badający złośliwy kod i przemysłowe oprogramowanie inżynieryjne
465
SHARES
1.5k
VIEWS
Udostępnij na FacebookuUdostępnij na Tweeterze

Firma SentinelOne opracowała pierwszy w branży benchmark typu „long-horizon”, służący do oceny zdolności zaawansowanych modeli sztucznej inteligencji w zakresie inżynierii wstecznej. Jako materiał testowy posłużyło złośliwe oprogramowanie Fast16, odkryte przez badaczy z SentinelLabs w kwietniu 2026 roku. Fast16 to szkodliwy kod z 2005 roku, zaprojektowany do ingerencji w oprogramowanie inżynieryjne LS-DYNA, które było wykorzystywane przez Iran w programie rozwoju broni jądrowej. Eksperci sugerują, że Fast16 – podobnie jak słynny Stuxnet – mógł być narzędziem sabotażu stworzonym przez Stany Zjednoczone.

Testowanie zdolności analitycznych AI

W ramach benchmarku sprawdzono, które z czołowych modeli AI potrafią przeprowadzić rzetelne i spójne śledztwo dotyczące złośliwego oprogramowania. Zamiast oceniać modele na podstawie pojedynczych, izolowanych zadań, badacze monitorowali, czy sztuczna inteligencja jest w stanie utrzymać logiczną ciągłość analizy przez osiem etapów o rosnącym stopniu trudności. W trakcie testów systematycznie wprowadzano nowe dowody, które podważały wcześniejsze wnioski wyciągnięte przez modele.

W testach wzięły udział następujące rozwiązania:

  • GPT-5.6 Sol (OpenAI)
  • GPT-5.5 (OpenAI)
  • GLM-5.2 (Z.ai)
  • Opus 4.7 oraz 4.8 (Anthropic)
  • Jedynym modelem, który pomyślnie ukończył wszystkie osiem etapów śledztwa, był GPT-5.6 Sol. Pozostałe modele, mimo poprawnej analizy lokalnej, utknęły na różnych etapach procesu. GPT-5.5 nie zdołał wyjść poza fazę początkową, natomiast modele z serii Opus miały tendencję do przedwczesnego kończenia pracy, zanim wszystkie błędy zostały wyeliminowane.

    Kluczowe wyzwanie: odzyskiwanie projektu

    Badacze z SentinelLabs wskazują, że różnica w wynikach nie wynika z braku wiedzy technicznej, lecz z umiejętności określanej jako „odzyskiwanie projektu” (project-scale recovery). Jest to zdolność modelu do wycofania się z błędnego wniosku, prześledzenia wszystkich zależności, które na nim bazowały, naprawienia przyczyny źródłowej i uwzględnienia tej korekty w dalszej części dochodzenia. Modele, które nie przeszły testu, ograniczały się jedynie do doraźnego łatania błędów, co uniemożliwiało im utrzymanie spójności analizy.

    Rola człowieka w procesie analizy

    Mimo sukcesu modelu GPT-5.6 Sol, badacze podkreślają, że nadzór ludzki pozostaje niezbędny. Nawet najbardziej zaawansowane systemy popełniały istotne błędy techniczne, akceptowały słabej jakości kontrolę i przedwcześnie ogłaszały gotowość raportów.

    Seniorzy zajmujący się inżynierią wsteczną pozostają niezbędni. Nawet najlepsze przebiegi testów zawierały błędy semantyczne, akceptowały słabe mechanizmy kontroli jakości i przedwcześnie deklarowały zakończenie prac. Obecnie oceniamy, że najlepszym zastosowaniem AI jest rola nadzorowanego agenta śledczego, gdzie analityk-człowiek definiuje cele, wskazuje luki w rozumowaniu i zachowuje ostateczną władzę nad publikacją wyników.

    Warto zauważyć, że w kontekście bezpieczeństwa IT, koszty incydentów związanych z naruszeniami danych mogą być ogromne. Przykładowo, niedawne straty wynikające z oszukańczych kontraktów po wycieku danych w Upbound Group wyniosły 13 milionów dolarów, co w przeliczeniu daje około 50 milionów złotych. Tak wysokie stawki sprawiają, że rola człowieka w weryfikacji działań AI pozostaje kluczowym elementem strategii obronnych.

    Share186Tweet116
    Poprzedni artykuł

    Inflect Micro v2 kompaktowy model syntezy mowy

    Następny artykuł

    Co Odyseja mówi o dawnej nauce od botaniki po psychiatrię

    Następny artykuł
    Starożytny badacz analizujący rośliny, narzędzia i przyrządy na tle Morza Śródziemnego

    Co Odyseja mówi o dawnej nauce od botaniki po psychiatrię

    Polub nas i bądź na bieżąco

    Ostatnie Wpisy

    • Beta testy One UI 9 dla serii Samsung Galaxy S25 wkrótce 27 lipca, 2026
    • Bristol Myers Squibb buduje zaawansowaną fabrykę AI na platformie NVIDIA Vera Rubin 27 lipca, 2026
    • Wyciek danych w MCBS dotknął ponad milion osób 27 lipca, 2026
    • Nowoczesna edukacja prawnicza w dobie sztucznej inteligencji 27 lipca, 2026
    • Ukryta różnorodność genetyczna pomogła wężom z Guam przetrwać mimo chowu wsobnego 27 lipca, 2026

    Informacje

    • Polityka cookies
    • Polityka prywatności
    • Polityka redakcyjna i korekty
    • Redakcja
    • Współpraca
    • REDAKCJA
    • WSPÓŁPRACA
    • POLITYKA PRYWATNOŚCI

    Welcome Back!

    Login to your account below

    Forgotten Password?

    Retrieve your password

    Please enter your username or email address to reset your password.

    Log In

    Add New Playlist

    Twoja prywatność

    Używamy niezbędnych plików cookies do działania serwisu. Za Twoją zgodą możemy także mierzyć czytelnictwo, personalizować treści i obsługiwać reklamy. Możesz zaakceptować wszystkie kategorie, odrzucić opcjonalne pliki cookies albo wybrać własne ustawienia.

    Niezbędne Always active
    Niezbędne do działania strony, bezpieczeństwa oraz zapisania wybranych ustawień prywatności.
    Preferencje
    Służą do zapamiętywania ustawień i poprawy wygody korzystania z portalu.
    Statystyka
    Pomagają mierzyć czytelnictwo i ulepszać portal. Są uruchamiane po wyrażeniu zgody. The technical storage or access that is used exclusively for anonymous statistical purposes. Without a subpoena, voluntary compliance on the part of your Internet Service Provider, or additional records from a third party, information stored or retrieved for this purpose alone cannot usually be used to identify you.
    Marketing
    Służą do wyświetlania i mierzenia reklam oraz działania wybranych usług zewnętrznych.
    • Manage options
    • Manage services
    • Manage {vendor_count} vendors
    • Read more about these purposes
    Ustawienia
    • {title}
    • {title}
    • {title}
    No Result
    View All Result
    • Apple
    • Sztuczna inteligencja AI
    • Komputery I tablety
    • Gry
    • Smartfony
    • Security
    • Nauka i technika
    • Lora
    • Współpraca
    • Redakcja