Claude markiert seit August 2026 jeden generierten Text mit einer unsichtbaren Wasserzeichen-Methode namens SynthID. Die Technik dahinter hat praktische Folgen für alle, die mit Claude Texte oder Code produzieren.
Security
Vercel Deepsec: Code-Security durch KI-Agenten
Vercel veröffentlicht Deepsec: Ein Open-Source-Tool, das KI-Agenten nutzt, um Schwachstellen im Code zu finden. Lokal, sicher und massiv skalierbar.
GPT-5.4-Cyber: Das ultimative KI-Tool für Dev-Security
OpenAI bringt GPT-5.4-Cyber: Erfahre, wie Entwickler exklusiven Zugang zu ungefilterten Security-Features, Agentic Coding und Automatisierung erhalten.
Claude Mythos: KI-Agent fixt Zero-Days autonom
Anthropic startet Project Glasswing: Erfahre, wie das neue KI-Modell Claude Mythos Zero-Day-Vulnerabilities in Codebases autonom findet und fixt.
Claude Code Security: KI-Schutz für deinen Code
Claude Code Security scannt Codebasen, findet komplexe Lücken und schreibt Patches. Jetzt in der Preview für Enterprise & Open Source Maintainer.
IronClaw: Dein sicherer, lokaler AI-Agent in Rust
Entdecke IronClaw: Der Open-Source AI-Agent in Rust mit Fokus auf Privacy. Mit WASM-Sandbox, lokaler Verschlüsselung und Self-Expanding Tools.
ChatGPT Lockdown Mode: Schutz vor Prompt Injection
Datensicherheit und die Kontrolle über Datenströme stehen bei der professionellen Nutzung von KI-Modellen oft an erster Stelle. OpenAI hat nun eine entscheidende Funktionserweiterung ausgerollt, die genau diese Bedenken adressiert. Mit der Einführung spezifischer Sicherheitsmodi reagiert das Unternehmen auf die Anforderungen von Enterprise-Kunden, die ihre sensiblen Geschäftsdaten vor ungewollten Zugriffen und Manipulationen schützen müssen. Besonders das Risiko von sogenannten „Prompt Injections“, bei denen Angreifer die KI manipulieren, um Daten abzugreifen, soll damit drastisch minimiert werden.
Sicherheit für AI-Agents: Wie OpenAI Datendiebstahl via Links verhindert
OpenAI detailliert die Sicherheitsarchitektur hinter seinem neuen „Operator“-Agenten, der Web-Interaktionen in einer isolierten Cloud-Sandbox statt lokal auf Nutzergeräten ausführt. Durch die Implementierung kryptographischer Signaturen nach RFC 9421 sollen Serverbetreiber und Firewalls mathematisch verifizieren können, dass ein Request tatsächlich von einem autorisierten KI-Agenten stammt. Wir analysieren, ob dieser serverseitige „Walled Garden“-Ansatz das Risiko von SSRF-Angriffen im Vergleich zu offenen Systemen wie Claude Computer Use effektiv eliminiert.
OpenAI enthüllt GPT-5.2-Codex: Neue Sicherheitsstandards für Coding-Agents
Mit einem Addendum zur System Card verschiebt OpenAI den Sicherheitsfokus von GPT-5.2-Codex radikal von Inhaltsmoderation auf funktionale Capabilities Safety. Das aktualisierte Modell blockiert Malware, Obfuscation und Prompt Injections nun direkt während der Token-Generierung, statt sich auf externe Guardrails zu verlassen.
Anthropic: KI-Systeme mit eigenen Konten bis 2025 in Firmennetzwerken erwartet
KI-Systeme mit eigenen Benutzerkonten und Zugriffsrechten werden bis 2025 in Firmennetzwerken arbeiten. Diese alarmierende Prognose stammt von Jason Clinton, dem Sicherheitsleiter des KI-Unternehmens Anthropic. Die sogenannten „virtuellen Mitarbeiter“ würden über eigenständige Erinnerungen verfügen und vollständige Arbeitsabläufe autonom durchführen können.