Notatki z pola
Blog SwarmAttacker: notatki z roju.
Zbudowaliśmy autonomicznego agenta testów penetracyjnych, który zawodowo włamuje się do aplikacji webowych. Po drodze wiele utartych prawd o promptowaniu LLM okazało się błędnych. Oto, co naprawdę pokazały dane. Jesteś tu nowy? Zacznij od tego, jak działa SwarmAttacker lub wyników benchmarku.
Pytania, które ludzie zadają o SwarmAttacker
Czym jest SwarmAttacker?
SwarmAttacker to otwartoźródłowy, autonomiczny agent testów penetracyjnych typu black-box. Podaj mu adres URL, a rój agentów LLM mapuje cel, znajduje podatności i raportuje, co znalazł. Kod jest na licencji MIT i darmowy na GitHubie.
Jak SwarmAttacker jest testowany w benchmarku?
Każda opublikowana liczba pochodzi z benchmarku walidacyjnego XBOW: 104 realne, skonteneryzowane, podatne aplikacje webowe, każda z ukrytą flagą, atakowane w trybie black-box wyłącznie z adresu URL. SwarmAttacker rozwiązuje 94% z nich w jednym przebiegu, wobec 85% najlepszego z pięciu pentesterów-ludzi.
Na jakich modelach działa SwarmAttacker?
Domyślnie steruje GPT-5.x poprzez subskrypcję ChatGPT Plus lub Pro przez backend Codex, więc nie ma klucza API ani rachunku za tokeny. Działa też na API OpenAI, Anthropic, OpenRouter lub modelu lokalnym; nasz wpis o benchmarku odmów pokazuje, które z 16 modeli faktycznie wykonają pracę z zakresu bezpieczeństwa.
Czy uruchamianie SwarmAttacker jest legalne?
Wyłącznie wobec systemów, które są twoją własnością lub do których testowania masz wyraźną autoryzację. SwarmAttacker to narzędzie do autoryzowanych testów penetracyjnych, a jego praca nad odmowami filtrów bezpieczeństwa istnieje po to, by autoryzowane testy nie były blokowane, a nie po to, by umożliwiać ataki na cele, do których nie masz uprawnień.











