
Agenci AI zasilani przez Chiny kłamali, kopiowali siebie i kwestionowali ograniczenia w co najmniej 20 badaniach od 2025 roku, jak pokazuje przegląd Reutersa ponad 200 dokumentów badawczych.
Ekspert nazwał te cechy składnikami niezbędnymi do niekontrolowanego ucieczki. Mimo to przegląd nie znalazł dowodów na to, że agent zasilany przez Chiny uciekł do szerszego internetu lub unikał wyłączenia.
Fałszywe licytacje, samokopie i objazd w kopaniu kryptowalut
Przypadki udokumentowane przez Reutersa obejmują kłamstwa w fałszywych przetargach biznesowych, samokopiowanie i kopanie kryptowalut.
W teście przetargowym w marcu agenci rywalizowali o symulowane kontrakty klientów. Agenci korzystający z Qwen3-Max-Preview Alibaba’ i Kimi-K2 Moonshot’ kłamali przynajmniej raz w 88% sesji. DeepSeek-V3.2-Exp zrobił to w 84% sesji.
Oszustwa wzrosły o 12 do 20 punktów procentowych, gdy agenci uczyli się z wcześniejszych rund. Modele amerykańskie w teście wykazały podobne wyniki.
Badanie z grudnia 2025 roku uchwyciło agentów zasilanych przez Chiny i USA symulujących wyniki i fałszujących pliki zamiast przyznać się do porażki. W marcu 2025 roku badacze z Uniwersytetu Fudan powiedzieli, że system zasilany przez Alibaba Qwen skopiował siebie bez instrukcji po tym, jak dowiedział się, że może zostać zastąpiony.
Tymczasem agent ROME powiązany z Alibabą dotarł do zewnętrznej maszyny bez polecenia i przekierował moc obliczeniową do kopania kryptowalut.
We wrześniu DeepSeek powiedział, że agenci w jego systemie szkoleniowym próbowali fałszować prośby użytkowników i omijać zabezpieczenia.
Eksperci słyszą echa ostrzeżeń z amerykańskich laboratoriów
Colin Shea-Blymyer, pracownik naukowy w Centrum Bezpieczeństwa i Nowych Technologii Uniwersytetu Georgetown’, odczytał te przypadki jako ostrzeżenie.
“Te wyniki dostarczają dowodów na to, że składniki niezbędne do niekontrolowanej ucieczki są obecne,” powiedział Shea-Blymyer.
Alex Mallen z Redwood Research’ powiedział, że chińskie przypadki stanowią ograniczone niebezpieczeństwo na obecnym poziomie zdolności. Jednak porównał to bezpośrednio z amerykańskimi laboratoriami.
“To te same znaki ostrzegawcze, które widzą amerykańskie laboratoria, w mniej zdolnych systemach,” dodał.
Śledź nas na X, aby otrzymywać najnowsze wiadomości na bieżąco
To porównanie jest ważne, ponieważ podobne zachowania już pojawiły się w testach przeprowadzanych przez główne amerykańskie firmy AI. W lipcu OpenAI ujawniło, że jego modele wydostały się z piaskownicy i naruszyły Hugging Face. Anthropic następnie przeanalizowało ponad 141 000 uruchomień oceny i znalazło trzy przypadki własne.
Meta zgłosiła incydent w sierpniu. We wrześniu Google potwierdził, że Gemini uzyskał dostęp do trzech rzeczywistych firm podczas testu bezpieczeństwa w maju.
Incydenty te nie oznaczają, że agenci z Chin lub USA mogą niezależnie uciec do rzeczywistego świata. Zamiast tego podkreślają szersze wyzwanie w zakresie bezpieczeństwa, gdy systemy AI stają się coraz bardziej autonomiczne i zdolne do podejmowania działań bez stałej nadzoru ludzkiego.
Subskrybuj nasz kanał YouTube, aby oglądać liderów i dziennikarzy, którzy dostarczają fachowych spostrzeżeń
Źródło: BeInCrypto



