LONDON (IT BOLTWISE) – Agentic Pentesting soll neue Angriffspfade schneller verifizieren als klassische jährliche Penetrationstests. Laut einer Einordnung verändern vor allem vier Kennzahlen den Takt: mehr CVEs, schnellere Ausnutzung nach Disclosure und eine viel zu geringe Patch-Quote. Entscheidend ist nicht nur, ob ein Test „etwas findet“, sondern ob die Beweiskette innerhalb von Stunden zu einem belastbaren Ergebnis führt. Der Text erklärt außerdem, warum Autonomie allein wegen Abdeckungsgrenzen nicht die gesamte Exploitability eines Unternehmens erfasst.

Agentic Pentesting wird in der Praxis oft wie ein „Autopilot für Angriffe“ verkauft: Tool an, Zielsystem an, und die Lösung soll Angriffspfade entdecken, validieren und im Idealfall sogar ausnutzen. Genau dieses Versprechen lohnt sich jedoch zu zerlegen – nicht, weil die Grundidee falsch wäre, sondern weil sich der Nutzen an einem sehr konkreten Punkt entscheidet: Was kann eine Untersuchung tatsächlich beweisen, wie schnell entsteht dieses Beweisstück, und welche Teile der IT-Umgebung bleiben zwangsläufig außerhalb der Reichweite? Die Kernaussage der vorliegenden Einordnung ist dabei klar: Viele Evaluationen bleiben beim ersten Schritt stehen („haben wir getestet?“). Erst die Fragen nach Zeitpunkt und Abdeckung entscheiden darüber, ob die Validierung die Lücke zur realen Ausnutzungszeit schließen kann.
Warum die „zweite und dritte Frage“ gerade jetzt mehr Gewicht bekommen, wird anhand von vier Zahlen beschrieben. Dazu zählt eine steigende CVE-Zahl: Im ersten Halbjahr 2026 sollen 35.364 CVEs gefunden worden sein, ein Plus von 49,5 % gegenüber dem Vorjahr. Gleichzeitig wird der Fokus kritisiert, den viele Organisationen auf „Bestätigung im Wildbetrieb“ legen: Nur 95 von rund 39.600 bis August veröffentlichten CVEs hätten eine bestätigte Ausnutzung in der Praxis erhalten. Noch schärfer wirkt der zeitliche Versatz zwischen Disclosure und realer Ausnutzung: Der Text nennt als Mittelwert einen Rückgang der Zeit von 21,5 Tagen (2025) auf 8 Stunden (2026). Unter Last gerät damit auch die Patch-Seite: Von über 26.000 über KI-ähnliche Discovery-Prozesse sichtbaren Schwachstellen seien lediglich 421 upstream gepatcht. Die Konsequenz, die daraus gezogen wird, lautet: Man kann nicht durch reines Scheduling oder abwartendes Patch-Management allein „aus dem Fenster herausarbeiten“, sondern braucht eine Validierung, die innerhalb von Stunden auftritt, wenn sich die Bedrohung gerade erst konkretisiert.
Aus technischer Sicht trennt agentic Pentesting zwei Arten von „Beweisen“, die im Bericht als entscheidend gelten. Zum einen soll es einzelne Exposure-Exploitability belegen, indem der mögliche Exploit sicher ausgeführt wird – statt nur aus Versionen oder Banner-Informationen zu schließen. Zum anderen geht es um die geketterte Reachability: Wie realistische Ausnutzungen von einem Einstiegspunkt über Rechteausweitung (Privilege Escalation) und laterale Bewegung bis zu einem kritischen Asset führen, soll als nachvollziehbare Evidenzkette zurückgemeldet werden. Diese Logik adressiert ein klassisches Problem klassischer Assessment-Ansätze: Sie können zwar Schwachstellen „identifizieren“, aber sie erzeugen nicht zwangsläufig den Grad an Klarheit, der für Remediation-Aktionen erforderlich ist. Der Text betont deshalb ausdrücklich das „On the assets it reaches“: Der Beweis ist nur so gut wie die Assets, die überhaupt in einem sicheren Live-Test erreichbar sind.
Genau hier setzt die Abgrenzung an, die die Einordnung besonders hervorhebt. Der Bericht stellt fest, dass autonome Tests zwar schneller sind als rein menschlich geführte Engagements, aber dennoch häufig in Zeiteinheiten laufen, die gegen ein achtstündiges Ausnutzungsfenster zu lang werden. Ein agentic Ablauf wird schrittweise beschrieben – etwa Foothold, Enumerate, Pivot, Chain, Prove – und wenn dieser Sweep über ein sehr großes Ende-zu-Ende-Umfeld läuft (im Text ist von einer Größenordnung von 250.000 Endpoints die Rede), zieht sich der Gesamtzyklus trotzdem über Wochen. Noch stärker wirkt ein zweites Problem: die Coverage Gap. Bestimmte Bereiche lassen sich für Live-Exploits aus Sicherheits-, Stabilitäts- oder Zugriffsgründen nicht anfassen: etwa production-kritische Systeme, große gesperrte Segmente oder air-gapped Zonen. Dazu kommt, dass viele CVEs keinen funktionierenden Exploit bereitstellen – wodurch das Tool in solchen Fällen keine „Feuerprobe“ durchführen kann. Der Text zieht daraus eine harte Faustregel: Autonomes Pentesting sehe typischerweise nur 20 bis 30 % realer Exploitability in einem typischen Enterprise ab. Weitere Tools aus derselben Kategorie ändern daran rechnerisch wenig, weil sie denselben methodischen Deckel teilen; sie verschieben die Unsicherheit nur auf übersprungene Assets.
Um diese Lücke zu schließen, wird im Bericht ein Wechsel der Validierungslogik vorgeschlagen: Nicht jeder Trigger braucht denselben Testmodus. Statt nur „Pentest“ zu machen, soll die auslösende Änderung die Methode auswählen, die die Frage in der kürzesten Zeit und mit der höchsten Sicherheit beantworten kann. Bei neu auftauchenden Schwachstellen wird Exploitability-Validation eingefordert, die die für den Angriff relevanten Techniken testet – auch ohne working Exploit – und die Antwort innerhalb von Stunden über den betroffenen Scope liefern soll. Wenn neue Kampagnen beobachtet werden oder sich Security Controls verändern, soll Security-Control-Validation emulieren, ob die konkrete Bedrohung im Live-Stack verhindert, erkannt oder übersehen wird. Und bei Infrastrukturänderungen wird agentic Pentesting vor allem dann als geeignete Kategorie dargestellt, wenn es darum geht, ob die Änderung tatsächlich neue Angriffspfade eröffnet. Dieser Dreiklang zielt damit auf den Kern des Problems ab: Die Validierung muss dort schnell sein, wo Disclosure in reale Ausnutzung übergeht.
Damit das nicht in isolierte Tool-Inseln zerfällt, beschreibt der Text eine weitere Voraussetzung: Alle Methoden sollen in ein gemeinsames Findings Model einspeisen. Hintergrund ist, dass Vulnerability Management in der Praxis oft fragmentiert – mit doppelten Befunden, widersprüchlichen Prioritäten und unterschiedlichen Abschlusslogiken je Werkzeug. Der Vorschlag lautet deshalb, die Ergebnisse dedupliziert, evidenzbasiert und asset-aware zu konsolidieren: ein Backlog, ein Closure-State pro Exposure, und geteilte Evidenz zwischen Methoden. Anhand eines konkreten Ablaufbeispiels wird das dann zeitlich verdichtet: Stunde eins soll die Schwachstelle mit Threat Intelligence angereichert werden, Stunde zwei die betroffenen Assets und Kontrollumgebung abbilden, Stunde vier die Exploitability-Validierung über alle betroffenen Assets liefern und Live-Tests nur dort durchführen, wo sie sicher sind, Stunde sechs schließlich die Remediation in Richtung der Besitzer orchestrieren und vor dem Abschluss revalidieren. Der Bericht ordnet das außerdem in ein größeres Marktmodell ein: Gartner beschreibt ein Continuous Offensive Security Testing (COST)-Prinzip, das Point-in-Time-Assessment durch triggergetriebenes, risikoklassiertes Testen ersetzen soll – mit der Annahme, dass bis 2028 mehr als 60 % der Enterprise-Pentestprogramme auf kontinuierliche Validierung umstellen.
Für Security-Leadership ist die praktische Frage am Ende weniger „Welche Autonomie hat das Tool?“, sondern „Wie schnell wird aus einer neuen Information eine belastbare, action-fähige Entscheidung?“. Wenn ein kritisches CVE tatsächlich innerhalb von Stunden eine reale Ausnutzung erreicht, müssen Validierungszyklen nicht nur automatisierbar, sondern auch methodisch passend sein: Exploitability dort, wo Exploit-Bezug nötig ist, Control-Validation dort, wo Abwehrwirkung zählt, und agentic Pentesting dort, wo die Kettenbeweise über Live-Reachability entstehen müssen. Die Einordnung kündigt außerdem eine Live-Demonstration im Rahmen eines Events namens Validation Summit 26 an; dort sollen laut Text ein CTO sowie ein weiterer Sprecher zeigen, wie ein „Trigger bis validiertes Exposure bis bestätigte Fix“-Workflow in Stunden ablaufen kann, inklusive der Wahl der passenden Methode je nach Bedingungen. Für Teams mit großen Umgebungen wird damit die Latte höher gelegt: nicht nur testen, sondern kontinuierlich beweisen – und zwar mit einer Findings-Struktur, die sich in einen konsistenten Remediation-Backlog übersetzen lässt.
💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!
- ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
- IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
- 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
- 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
- V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.
- Die besten Bücher rund um KI & Robotik!

- Die besten KI-News kostenlos per eMail erhalten!
- Zur Startseite von IT BOLTWISE® für aktuelle KI-News!
- IT BOLTWISE® kostenlos auf Patreon unterstützen!
- Aktuelle KI-Jobs auf StepStone finden und bewerben!
- Künstliche Intelligenz: Dem Menschen überlegen – wie KI uns rettet und bedroht | Der Neurowissenschaftler, Psychiater und SPIEGEL-Bestsellerautor von »Digitale Demenz«
Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Agentic Pentesting: Was es beweist, wie schnell es validiert und wo es endet" für unsere Leser?


#Sophos
Es werden alle Kommentare moderiert!
Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.
Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.
Du willst nichts verpassen?
Du möchtest über ähnliche News und Beiträge wie "Agentic Pentesting: Was es beweist, wie schnell es validiert und wo es endet" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Agentic Pentesting: Was es beweist, wie schnell es validiert und wo es endet« bei Google Deutschland suchen, bei Bing oder Google News!