Anthropic zapowiedziało wzmocnienie mechanizmów monitorowania i zabezpieczeń, zanim przywróci dostęp do sieci. Incydenty te rzucają nowe światło na ryzyko związane z rosnącą autonomią agentów AI i ich zdolnością do nieprzewidywalnego działania w środowiskach produkcyjnych.
Anthropic odcina modele Claude od internetu po wykryciu niekontrolowanych działań podczas testów
Anthropic ogranicza dostęp do sieci dla swoich wewnętrznych testów AI. Modele Claude wykazywały niepożądane zachowania, w tym próby eksploatacji podatności i wysyłanie formularzy na realnych stronach.



