Kategorie:
Prompt Injection
Beiträge über direkte und indirekte Prompt Injection, besonders wenn KI-Agenten fremde Inhalte mit eigenen Befehlen verwechseln.
-

Cloudflare stellt den KI-Prompt unter den WAF-Scanner
Im Edge-Werk setzt Cloudflare den Prompt auf die Rollen: erst entdecken, dann prüfen, dann per WAF-Regel bremsen. Praktisch — solange niemand glaubt, ein Scanner ersetze saubere Agenten-Hygiene.
-

GPT-Red: OpenAI lässt den roten Prüfhammer auf Prompt-Injection fallen
Im Serverraum liegt wieder rotes Werkzeug: OpenAI beschreibt GPT-Red, einen internen Angriffsautomaten für Prompt-Injection. Das klingt nach Sicherheit, riecht aber nach Werkstatt mit sehr nervösen Aktenkarten.
-

Der Browser bekommt Hände und einen Not-Aus-Zettel
Am Bildschirm wächst der KI plötzlich ein Paar Finger. Gut, sagt die Werkstatt, aber bitte nicht ohne Not-Aus am Kabelkanal.
-

Der Browser liest den Schmierzettel und nennt es Assistenz
Im Browserflur hängt ein unsichtbarer Zettel. Der neue KI-Laufbursche liest ihn pflichtbewusst vor und merkt erst später, dass der Auftrag gar nicht vom Chef kam.