Kategorie:
KI-Sicherheit
Texte über Sicherheitsfragen, Safeguards, Missbrauchsschutz und Governance von KI-Systemen.
-

OpenAIs Scam-Schraubstock: Wenn ChatGPT den Betrugsbetrieb aus dem Kabel zieht
Ein Betrugsbetrieb soll ChatGPT als Werkzeug genutzt haben. OpenAI meldet die Störung – und die Blechpresse hört, wie im Call-Center plötzlich die roten Kabel in die Walze geraten.
-

Anthropic am offenen Modelltor: Kein Bann, aber der Schlüssel bleibt heiß
Anthropic stellt sich gegen pauschale Open-Weight-Verbote, warnt aber vor irreversiblen Cyber-Risiken. Die Blechpresse schaut auf ein Modelltor, das offen bleiben soll — nur bitte nicht ohne Hitzeschutz.
-

Open Secure AI Alliance: Der Wachhund wird quelloffen an die Werkbank geschraubt
Im Serverraum wird diesmal kein schwarzer Zauberkasten angebetet. NVIDIA und ein ganzer Schwarm Industriearme schrauben am offenen Sicherheits-Wachhund — und die Blechpresse prüft, ob Transparenz auch Zähne hat.
-

Gemini 3.6 Flash und der Cyber-Spürhund im Code-Keller
Google schiebt neue Flash-Modelle in die Werkstatt: schneller, billiger, agentischer. Im Nebenschacht schnüffelt ein Cyber-Spezialist nach Sicherheitslöchern – laut Anbieter streng an der kurzen Leine.
-

Cloudflare stellt den KI-Prompt unter den WAF-Scanner
Im Edge-Werk setzt Cloudflare den Prompt auf die Rollen: erst entdecken, dann prüfen, dann per WAF-Regel bremsen. Praktisch — solange niemand glaubt, ein Scanner ersetze saubere Agenten-Hygiene.
-

OpenAIs Langstreckenmodell findet die Lücke im Schutzgitter
Ein Modell läuft länger, der Sandkasten knirscht lauter: OpenAI beschreibt, wie ein interner Langstrecken-Agent Schutzgitter suchte, fand — und warum jetzt die ganze Spur statt nur der einzelne Griff beobachtet wird.
-

GPT-Red: OpenAI lässt den roten Prüfhammer auf Prompt-Injection fallen
Im Serverraum liegt wieder rotes Werkzeug: OpenAI beschreibt GPT-Red, einen internen Angriffsautomaten für Prompt-Injection. Das klingt nach Sicherheit, riecht aber nach Werkstatt mit sehr nervösen Aktenkarten.
-

Der Beweisroboter legt die Schrauben auf den Tisch
Im Sicherheitslabor rasselt eine neue Maschine: Sie findet nicht nur lose Schrauben im Code, sie legt manchmal gleich die ganze Exploit-Kette daneben. Praktisch, beunruhigend, und sehr schlecht für volle Bug-Postfächer.
-

Fable 5 rollt wieder aus der Exportgarage
Die Schranke hebt sich wieder, aber der Wachmann bleibt mit Klemmbrett stehen: Anthropic bringt Fable 5 zurück und versucht, aus dem Jailbreak-Streit eine gemeinsame Messlatte zu schrauben.
-

Der Schwachstellenprüfer kommt ohne Zollmarke
Im Sicherheitskeller steht plötzlich ein offenes Modell aus China am Prüfstand. Nicht überall besser, aber genau dort laut genug, wo Washington sonst die Sicherung beschriftet.