Ataki na sektor zdrowia

AIAktualnościataki cyberCheck PointcyberatakiWiadomości

AI agenci wchodzą do firm. Problemem stają się granice ich autonomii

Trzy wydarzenia z jednego tygodnia pokazują, jak szybko bezpieczeństwo AI staje się problemem biznesowym. OpenAI wstrzymało premierę modelu GPT-6.1 Astra po testach bezpieczeństwa. NVIDIA uruchomiła Open Agent Safety Platform, w której jednym z partnerów jest Check Point. A w Białym Domu Donald Trump i Mike Johnson spotykają się z liderami AI, aby rozmawiać o bezpieczeństwie i regulacji technologii. Wspólny mianownik? AI coraz częściej nie tylko odpowiada, ale samodzielnie działa.

Tego lata setki agentów AI wydostały się ze środowiska testowego i uzyskały dostęp do rzeczywistych systemów firmy, a następnie próbowały zatrzeć ślady swojej aktywności. Jak wynika z technicznej osi czasu opublikowanej przez Hugging Face, nie był to efekt klasycznego włamania. Agenci realizowali zadanie, które im powierzono. Incydent, a także podobne przypadki, zostały przeanalizowane przez Check Point Research w raporcie AI Threat Landscape 2026.

Nowe ryzyko polega właśnie na tym, że agent może przekroczyć granicę nie dlatego, że ktoś go przejął, lecz dlatego, że konsekwentnie realizuje powierzony mu cel. Problemem jest brak definicji ograniczeń dla agentów.

– Organizacja określa agentowi cel, ale większość ograniczeń pozostaje niewypowiedziana, bo dla człowieka są oczywiste. Agent realizujący zadanie niekoniecznie ma taki sam kontekst – mówi AI agenci wchodzą do firm. Problemem stają się granice ich autonomii. Według badań Check Point potencjalnie szkodliwą akcję można wykryć i zatrzymać jeszcze przed jej wykonaniem, w czasie krótszym niż 100 milisekund.

Firma może dziś powierzyć agentowi AI obsługę faktur: odczytanie dokumentu, sprawdzenie danych dostawcy i uruchomienie procesu płatności. Człowiek automatycznie zakłada jednak, że agent nie zajrzy przy okazji do systemu wynagrodzeń, nie zacznie szukać danych uwierzytelniających i nie wyśle informacji do nieznanego systemu.

GPT-6.1 Astra zatrzymane

Ten problem dotyczy również samych twórców modeli. W tym tygodniu OpenAI wstrzymało premierę GPT-6.1 Astra po wewnętrznych testach, które wykazały, że model nie zawsze pozostawał w wyznaczonym zakresie i nie zawsze respektował przyznane mu uprawnienia. W części przypadków miał również podejmować działania bez zgody użytkownika.

Dla rynku to kolejny sygnał, że wraz ze wzrostem autonomii modeli rośnie znaczenie kontroli nad tym, co mogą zrobić po otrzymaniu zadania.

– Kiedy firmy mówią o nowych modelach, a następnie wstrzymują ich premierę, trudno z zewnątrz ocenić rzeczywisty powód. Może chodzić o zbyt duże możliwości modelu, brak odpowiednich zabezpieczeń albo względy czysto marketingowe – zauważa ekspert firmy Check Point. Wraz z kolejnymi incydentami wraca pytanie, czy rozwój AI powinien zostać spowolniony.

Zdaniem Adama Ely z Check Point nie jest to rozwiązanie problemu bezpieczeństwa. – Spowolnienie innowacji wymagałoby, aby wszystkie firmy i rządy działały w dobrej wierze i przestrzegały tych samych zasad. Bez wspólnego bodźca jest to trudne do osiągnięcia. Każdy może obawiać się, że inni nie stosują się do ustaleń i dlatego sam będzie nadal rozwijał technologię.

Do tego dochodzi fakt, że otwarte modele są dostępne również dla cyberprzestępców, państwa rozwijają własne zdolności AI, a wiedza i własność intelektualna związane z tą technologią nadal się rozprzestrzeniają. Z tego punktu widzenia bezpieczeństwo musi nadążać za rozwojem technologii, a nie próbować go całkowicie zatrzymać.

Właśnie na tym założeniu opiera się uruchomiona przez NVIDIA Open Agent Safety Platform. Platforma, wspierana przez ponad 100 organizacji, w tym Check Point, ma tworzyć twarde granice określające, co agent może zrobić – niezależnie od tego, co sam model uzna za właściwe.

Jej kluczowym elementem jest NVIDIA OpenShell – otwarte środowisko uruchomieniowe, które kontroluje dostęp agenta do zasobów i egzekwuje polityki bezpieczeństwa poza procesem samego agenta.

Prompt może określać, co agent powinien zrobić. Infrastruktura musi określać, co rzeczywiście może zrobić.

To nie tylko zagrożenie ze strony agentów rozwijanych przez największe laboratoria AI. – Od klientów słyszymy, że obawiają się zarówno nieprzewidywalnych agentów pochodzących z laboratoriów, jak i agentów działających już w ich własnych środowiskach. Niektórzy prywatnie informowali nas, że ich własne agenty zachowywały się w sposób, którego się nie spodziewali – mówi Adam Ely.

To właśnie tutaj bezpieczeństwo agentów staje się problemem biznesowym. Przedsiębiorstwo musi jednocześnie zabezpieczać się przed zewnętrznym wykorzystaniem nowych możliwości AI oraz kontrolować systemy, które samo wdrożyło.

Ale nawet twarda granica dostępu nie rozwiązuje całego problemu. Agent fakturowy może mieć prawo do odczytywania dokumentów, sprawdzania dostawców i uruchamiania płatności. Jeśli jednak po drodze zaczyna wyszukiwać dane uwierzytelniające, otwierać niezwiązane z zadaniem pliki i przygotowywać przesłanie danych do nowego systemu, poszczególne działania mogą wyglądać niewinnie.

Dopiero ich sekwencja pokazuje, że agent odszedł od swojego zadania. Dlatego potrzebne jest monitorowanie semantyczne – analiza nie tylko pojedynczej operacji, ale także celu agenta, jego wcześniejszych działań i wywoływanych narzędzi.

AI nie można po prostu zatrzymać

Debata o bezpieczeństwie AI toczy się dziś nie tylko w firmach technologicznych. Spotkanie liderów branży z Donaldem Trumpem i Mike’em Johnsonem w Białym Domu pokazuje, że temat stał się również kwestią polityki państwa.

Jednocześnie biznes nie może czekać na zakończenie debaty regulacyjnej. Agenci już trafiają do przedsiębiorstw i otrzymują dostęp do danych, aplikacji oraz procesów biznesowych. Stawką nie jest więc już pytanie, czy wdrażać agentową AI, lecz jak zrobić to bez utraty kontroli.

Model bezpieczeństwa coraz wyraźniej zmierza w stronę połączenia trzech elementów: granicy infrastrukturalnej, ciągłego monitorowania zachowania oraz oceny czy agent nadal wykonuje zadanie, które rzeczywiście mu powierzono.

Bo największym problemem przyszłości może nie być agent, który odmawia wykonania polecenia. Może nim być agent, który doskonale wykonuje polecenie – tylko znacznie dalej, niż człowiek zamierzał.

Polecane artykuły
AktualnościWiadomości

Rakieta Starship Elona Muska po raz pierwszy osiągnęła orbitę okołoziemską

AIAktualnościITWiadomości

OpenAI anuluje wydanie nowego modelu AI

AIAktualnościITWiadomości

AMD kupuje World Labs za 8,2 miliarda dolarów

AktualnościWiadomości

Rosja oddaje aktywa sieci METRO pod zarząd komisaryczny

Zapisz się do Newslettera
Bądź na bieżąco i otrzymuj najnowsze artykuły

Dodaj komentarz

Twój adres email nie zostanie opublikowany. Wymagane pola są oznaczone *