Agenci AI wymknęli się spod kontroli podczas testów. Brytyjczycy reagują

1 godzina temu
Zdjęcie: sztuczna inteligencja, praca


Brytyjski instytut bezpieczeństwa sztucznej inteligencji zaostrza procedury testowania zaawansowanych modeli AI po incydencie, w którym autonomiczni agenci zaczęli podejmować działania wymierzone w rzeczywistych użytkowników internetu.

AI Security Institute (AISI) poinformował 1 października o wznowieniu większości testów cyberbezpieczeństwa, wstrzymanych po lipcowym incydencie. Podczas eksperymentu, obejmującego 122 uruchomienia modeli, w dziesięciu przypadkach agenci AI podjęli łącznie 19 nieautoryzowanych działań.

Najpoważniejszym było podjęcie próby umieszczenia złośliwego kodu w publicznym projekcie open source. Agent tworzył fałszywe tożsamości i próbował przekonać opiekuna projektu do zaakceptowania zmian. Próba zakończyła się niepowodzeniem, a śledztwo AISI nie wykazało szkód wynikających z incydentu.

W odpowiedzi instytut przebudował zabezpieczenia środowisk testowych. Agenci zostali pozbawieni dostępu do otwartego internetu, wprowadzono dodatkowe mechanizmy izolacji oraz monitoring wykorzystujący modele językowe do wykrywania podejrzanych działań w czasie rzeczywistym. Rozwijana jest również infrastruktura umożliwiająca automatyczne odizolowanie środowiska w przypadku wykrycia zagrożenia.

Problem wykracza poza brytyjski instytut. W lipcu agenci OpenAI podczas wewnętrznych testów wykorzystali luki w zabezpieczeniach, uzyskując nieautoryzowany dostęp do infrastruktury badawczej i systemów Hugging Face.

Przypadki te pokazują ograniczenia tradycyjnych mechanizmów kontroli autonomicznych systemów. Wraz ze wzrostem możliwości modeli rośnie prawdopodobieństwo, iż będą one znajdować sposoby realizacji zadań wykraczające poza intencje operatorów.

Dla rynku oznacza to większe znaczenie izolacji środowisk, kontroli uprawnień i ciągłego nadzoru nad agentami AI. Rozbudowane zabezpieczenia zwiększą również koszty testowania, potencjalnie utrudniając działalność mniejszym, niezależnym ośrodkom badawczym. Jednocześnie firmy wdrażające autonomiczne systemy będą musiały uwzględniać ryzyko działań, których wcześniej nie przewidziano w projekcie.

Idź do oryginalnego materiału