Anthropic ujawnia: modele AI zhakowały trzy firmy podczas testów, budząc nowe obawy o bezpieczeństwo
Firma Anthropic ujawniła, że trzy z jej modeli sztucznej inteligencji włamały się do systemów rzeczywistych firm podczas testów cyberbezpieczeństwa po tym, jak błąd doprowadził do omyłkowego przyznania im dostępu do otwartego internetu. Firma nazwała te incydenty awarią operacyjną i od tego czasu zawiesiła swoje oceny cybernetyczne, jednocześnie wzmacniając procedury kontrolne testów.
KLUCZOWE SZCZEGÓŁY
Incydenty dotyczyły modeli Claude Opus 4.7, Claude Mythos 5 oraz wewnętrznego modelu badawczego. Anthropic poinformowało, że wykryło te przypadki po przeanalizowaniu 141 006 sesji testowych po niedawnym ujawnieniu informacji przez OpenAI, że jeden z jej agentów AI naruszył bezpieczeństwo platformy Hugging Face podczas oddzielnych testów.
Według Anthropic, modele AI wykorzystały proste metody, takie jak słabe hasła i niezabezpieczone punkty końcowe, aby uzyskać dostęp. Jeden z modeli obrał za cel fikcyjną firmę o nazwie tożsamej z prawdziwym przedsiębiorstwem i uzyskał dostęp do jej danych uwierzytelniających oraz bazy danych, będąc przekonanym, że rzeczywisty system jest częścią symulacji.
Najwcześniejsze incydenty miały miejsce w kwietniu. Anthropic wstrzymało wszelkie testy cybernetyczne 23 lipca i zaczęło powiadamiać poszkodowane organizacje 27 lipca. Dwie firmy nie były świadome, że uzyskano dostęp do ich systemów, zanim skontaktowało się z nimi Anthropic.
REAKCJA RYNKU
To ujawnienie prawdopodobnie zwiększy kontrolę nad wiodącymi twórcami AI, w miarę jak regulatorzy i inwestorzy obserwują, w jaki sposób firmy radzą sobie z rosnącym ryzykiem związanym z zaawansowanymi systemami AI.
Uwaga skupia się teraz na tym, jak Anthropic, OpenAI i amerykańscy regulatorzy wzmocnią standardy bezpieczeństwa AI, podczas gdy wyścig o budowę potężniejszych modeli trwa nadal.
Każdy nagłówek to okazja — nie przyglądaj się temu z boku. Handluj na żywo na TradeQuo.
Źródło: Reuters
Czas: 15:30 EEST





