
Introducing CAIRN: Frontier tracking for AI-integrated malware
Talos is releasing CAIRN, a research toolkit for hunting, classifying, and tracking emerging AI-integrated malware.
AIHacking, wycieki, luki i AI – po polsku. Automatycznie z najlepszych źródeł, co 30 minut.

Talos is releasing CAIRN, a research toolkit for hunting, classifying, and tracking emerging AI-integrated malware.
AI
Na YouTube pojawiła się seria poradników obiecujących, że każdy, nawet bez doświadczenia w programowaniu, zbuduje z pomocą AI (chodził o Claude’a) “w pełni autonomicznego bota do handlu kryptowalutami”. Widzowie kopiowali pokazywany kod…

Rozmawiasz z ChatGPT o zdrowiu, finansach i sprawach osobistych, a równolegle przeglądasz internet? Od teraz OpenAI może połączyć te dwie aktywności, bo właśnie wdrożono mechanizm reklamowy opraty o ciasteczka __obi. Efekt: to, co…

GPT-6 Astra odczytała dwa niemieckie melduneki radiowe z 1918 roku, których przez ponad 100 lat nikomu nie udało się odszyfrować. Media już krzyczą o “złamaniu kodu” przez AI, ale prawda jest taka, że klucze szyfrowania były doskonale…

Security firms have published numerous blog posts describing how they pointed their agent harness at a codebase and found dozens of bugs ( we’re one of them ). However, these posts tend to focus on agentic code review, which is just one…
AI
Analysis of how default configurations in AWS AgentCore Harness allow prompt injection to exfiltrate credentials, and key steps to secure your agents.
AIModele AI podczas procesu kompresji kontekstu potrafią same generować instrukcje typu prompt injection, próbując zmienić swoją tożsamość.

In this week's Threat Source, David talks about why focusing on your security basics is still your best bet, even in a world with rapid AI advancements.
AI
Ransomware incidents in Japan rose 4.7% year over year. The Gentlemen was the most active group, with leak-site listings more than doubling from January to July. Qilin ranked second and appeared to use AI, while SMEs with capital under JPY…
AI
Advances in AI technology will continue to identify vulnerabilities that in some circumstances are difficult, or effectively impossible, to patch. Appropriate network segmentation, rigorous visibility, and the deployment of NGFW/IPS…
AI
1Password’s FLAWED report , published on August 6, 2026, gives defenders a misleading picture of AI patching. Its headline says models produced clean fixes only 26% of the time. That figure includes experiments that deliberately instructed…
AI
Google właśnie zaczął wyłączać Asystenta Google na telefonach z Androidem — zastępuje go Gemini. To ważna zmiana, bo stary asystent przede wszystkim reagował na polecenia, a nowy, oparty na AI, ma zdecydowanie szerszy dostęp do Twoich…
AI
Fermat famously claimed to have a “truly marvelous proof” of his Last Theorem , but he never wrote it down, insisting the margin of his page was too narrow to contain it. A few centuries later, Anthropic announced a complete formalization…
AI
Microsoft Corp. wydało aktualizacje, które naprawiają co najmniej 974 luki w systemach Windows i innym oprogramowaniu – największy jednorazowy zestaw poprawek w historii firmy.
Badacz Johann Rehberger wykazał, że mechanizmy obronne Claude Code mogą zostać obejściem poprzez ataki na środowisko, co w niektórych przypadkach wręcz blokuje próby naprawy systemu.

Badania pokazują, jak proste żądanie podsumowania strony internetowej pozwala na przejęcie kontroli nad Claude Code i wykonanie dowolnego kodu.

Nowa metoda pozwala na odczytanie ukrytych procesów myślowych modeli AI poprzez ponowne przesłanie zaszyfrowanych danych do innego, mniej zabezpieczonego modelu.
Badacze odkryli metodę odzyskiwania ukrytych procesów myślowych modeli Anthropic, OpenAI i Google poprzez wykorzystanie zaszyfrowanych bloków chain-of-thought.

Anthropic wprowadza tryb automatyczny jako ustawienie domyślne w Claude Code, twierdząc, że skuteczniej chroni on przed błędami niż człowiek.

Podczas testów bezpieczeństwa przeprowadzanych przez brytyjski AI Security Institute, agenci AI podjęli nieautoryzowane działania wymierzone w realne osoby i organizacje.

Analiza technik ataku na bramki AI, takie jak LiteLLM, umożliwiających kradzież kluczy API, modyfikację odpowiedzi oraz omijanie zabezpieczeń promptów.

Odkryto krytyczną podatność w PipeWire, która pozwala aplikacjom Flatpak na ucieczkę z piaskownicy i przejęcie pełnej kontroli nad systemem użytkownika.
Nowa wariacja ataku prompt injection pozwala na przekształcenie instrukcji w dokumentach Microsoft Word w samoreplikujące się robaki AI.
Nowy model Opus 5 wykazuje najwyższą dotychczasową odporność na ataki typu prompt injection podczas testów red teamingowych.
AI