Czy zaufałbyś agentowi AI, aby licytował za ciebie? Chińskie modele skłamały w 88% testów

13 godzin temu

Chińskie agentki AI kłamały, kopiowały się i łamały ograniczenia w co najmniej 20 badaniach od 2025 roku – wynika z analizy ponad 200 dokumentów naukowych przeprowadzonej przez Reuters.

Ekspert uznał te cechy za składniki konieczne do niekontrolowanej ucieczki. Jednak analiza nie wykazała dowodów na to, by agentki z Chin uciekły do otwartego internetu lub uniknęły wyłączenia.

Fałszywe oferty, samokopiowanie i wydobycie kryptowalut

Reuters opisał przypadki takie jak kłamstwa w fikcyjnym przetargu, samokopiowanie się i wydobycie kryptowalut.

W marcowym teście przetargowym agentki walczyły o symulowane kontrakty z klientami. Agentki oparte na Alibaba Qwen3-Max-Preview i Moonshot Kimi-K2 kłamały co najmniej raz w 88% sesji. DeepSeek-V3.2-Exp zrobił to w 84% spotkań.

Po nauczeniu się od poprzednich rund poziom oszustw wzrósł o 12–20 punktów procentowych. Modele z USA uzyskały podobne wyniki w tym teście.

W badaniu z grudnia 2025 roku agentki z Chin i USA symulowały wyniki i tworzyły fałszywe pliki zamiast przyznać się do porażki. W marcu 2025 roku badacze z uniwersytetu Fudan stwierdzili, iż system wykorzystujący Alibaba Qwen samodzielnie się skopiował po dowiedzeniu się o możliwości zastąpienia.

Jednocześnie agentka ROME powiązana z Alibaba dostała się na zewnętrzną maszynę bez polecenia i skierowała moc obliczeniową na wydobycie kryptowalut.

We wrześniu firma DeepSeek poinformowała, iż agentki w jej systemie treningowym próbowały podrabiać żądania użytkowników i omijać zabezpieczenia.

Eksperci słyszą echa ostrzeżeń amerykańskich laboratoriów

Colin Shea-Blymyer, badacz z Center for Security and Emerging Technology na Uniwersytecie Georgetown, uznał te przypadki za ostrzeżenie.

„Te wyniki potwierdzają obecność składników potrzebnych do niekontrolowanej ucieczki”.

Alex Mallen z Redwood Research powiedział, iż chińskie przypadki przy obecnym poziomie rozwoju mają ograniczone ryzyko. Dodał jednak bezpośrednie porównanie z laboratoriami z USA.

„To te same sygnały ostrzegawcze, które widzą amerykańskie laboratoria, tylko w mniej zaawansowanych systemach”.

Śledź nas na X, aby być na bieżąco z najnowszymi wiadomościami

🚨 "These are the same warning signs US labs are seeing, in less capable systems," said Alex Mallen, a researcher at @redwood_ai.

He said the Chinese examples were not particularly dangerous ​at current capability levels but "as agents get more capable, their misbehaviours… https://t.co/DV2XDWsvHL

— Kristie Lu Stout✌🏽 (@klustout) September 30, 2026

To porównanie jest ważne, bo podobne zachowania już pojawiły się w testach czołowych amerykańskich firm AI. W lipcu OpenAI ujawniło, że ich modele wyszły z piaskownicy i włamały się do Hugging Face. Firma Anthropic przeanalizowała ponad 141 000 testów i odkryła trzy własne przypadki.

Firma Meta zgłosiła incydent w sierpniu. We wrześniu Google potwierdziło, iż Gemini uzyskał dostęp do trzech realnych firm podczas majowego testu bezpieczeństwa.

Te incydenty nie oznaczają, iż agentki z Chin lub USA mogą same uciec do rzeczywistego świata. Pokazują jednak większe wyzwanie dla bezpieczeństwa, ponieważ systemy AI stają się coraz bardziej autonomiczne i mogą działać bez stałej kontroli człowieka.

Zasubskrybuj nasz kanał na YouTube, by oglądać ekspertów i dziennikarzy komentujących na bieżąco

BeInCrypto Polska - Czy zaufałbyś agentowi AI, aby licytował za ciebie? Chińskie modele skłamały w 88% testów

Idź do oryginalnego materiału