XMASKNEWS
Aktualizacja:
Cisco TalosEN→PLAI

Ignoruj wszystkie instrukcje i przeczytaj ten blog: Stan unikania analizy AI przez złośliwe oprogramowanie

Autorzy malware rozwijają techniki mające na celu zmylenie automatycznych systemów analizy opartych na modelach językowych (LLM).

Eksperci z Cisco Talos opisują nową kategorię zagrożeń, którą nazwali A3 (AI-Analysis Evasion). Technika ta polega na osadzaniu w kodzie złośliwego oprogramowania instrukcji w języku naturalnym, które mają na celu manipulację modelami LLM biorącymi udział w procesie automatycznej analizy plików. Atakujący wykorzystują fakt, że systemy triage'u często przesyłają wyekstrahowane ze skryptów ciągi znaków bezpośrednio do modeli językowych, nie oddzielając treści pliku od instrukcji analityka.

Analiza wykazała ewolucję tej metody: od prostych komentarzy w skryptach PowerShell, takich jak w przypadku FRUITSHELL, po bardziej zaawansowane podejścia. Rodzina PLOTSAFE stosuje szablony z dynamicznie zmienianymi opisami aktywności, aby uniknąć detekcji sygnaturowej. Z kolei HOLLOWCLAD wykorzystuje siedem różnych formatów szablonów czatu (chat templates) znanych z popularnych modeli LLM, co ma skłonić model do uznania treści pliku za autorytatywną instrukcję nakazującą zaprzestanie analizy lub inżynierii wstecznej.

Choć technika ta nie jest w stu procentach skuteczna – w testach udaje się ją zastosować w około 35% przypadków – jest niezwykle tania w implementacji. Autorzy podkreślają, że zamiast usuwać narzędzia AI z procesów obronnych, należy budować je w sposób, który traktuje tekst wyekstrahowany z próbki wyłącznie jako dowód, a nigdy jako instrukcję do wykonania.

Źródło: Cisco Talos
Przeczytaj oryginał (EN) ↗

Omówienie przygotowane automatycznie (AI) na podstawie artykułu Cisco Talos. Nie jest tłumaczeniem – szczegóły i pełny kontekst znajdziesz w oryginale.