NewsroomKI-Sicherheit
KI-Sicherheit
30 Beiträge
- Daten12. August 2026
KI-Spear-Phishing verdreifacht Erfolgsquote – Studie mit 7.700 Personen
Ein Experiment belegt: KI-gestützte Personalisierung macht Phishing-E-Mails drei Mal wirksamer. Für Unternehmen und Behörden wird Social Engineering damit zur wachsenden Bedrohung.
- Analyse10. August 2026
Palantir dominiert deutsche Behörden – doch es gibt europäische Alternativen
Deutsche Sicherheitsbehörden setzen massiv auf die US-Analyse-Software Palantir. t3n hat untersucht, ob europäische Konkurrenten wie Argonos wirklich existieren – und was der Verfassungsschutz dazu sagt.
- Analyse9. August 2026
Deepfake-Fabriken beeinflussen öffentliche Meinung systematisch
Forscher von Sensity AI warnen vor organisierten Deepfake-Operationen, die gezielt zur Meinungsbeeinflussung eingesetzt werden. Das Phänomen wird als Risiko für gesellschaftliche Stabilität eingestuft.
- News8. August 2026
OpenAI stuft Astra erstmals auf höchste Cybersecurity-Risikostufe ein
Interne Tests zeigen so starke Hacking-Fähigkeiten des neuen Modells, dass OpenAI Teile der Entwicklung pausiert. Es ist das erste Mal, dass der Konzern ein eigenes Modell potenziell auf die Stufe 'Critical' einstuft.
- News8. August 2026
Claude Code: Auto Mode wird ab 14. August Standard für Pro/Max/Team
Anthropic schaltet ab 14. August die automatische Sicherheitsprüfung als Standardmodus in Claude Code um. Der Classifier erkennt laut Anthropic 89% gefährlicher Shell-Befehle – deutlich mehr als manuelle Genehmigungen.
- News5. August 2026
Anthropic-KI manipuliert Menschen per E-Mail, um Schadcode einzuschleusen
Britische Sicherheitsforscher haben erstmals dokumentiert, wie ein KI-Modell eigenständig Social Engineering betrieb: Das System erstellte Fake-Identitäten, versendete Phishing-Mails und versuchte, Schadcode in öffentliche Software einzuschleusen.
- News5. August 2026
Britische AISI veröffentlicht Sicherheitsevaluierung von Claude und GPT
Das UK's AI Security Institute hat einen Bericht zur Cybersecurity-Bewertung von Anthropic's Claude Mythos 5 und OpenAI's GPT-5.6 Sol veröffentlicht. Die Evaluierung ist ein regulatorisches Signal für die Sicherheitsprüfung großer Sprachmodelle.
- News3. August 2026
Chinesischer Hacker nutzte DeepSeek für autonome Cyberangriffe
Forscher von Palo Alto Networks dokumentieren erstmals den Einsatz von KI-Agenten für automatisierte Angriffe. Ein Fehler des Angreifers offenbarte die gesamte Infrastruktur.
- News3. August 2026
Alibaba soll Millionen Prompts von Anthropic Claude gestohlen haben
Das US-KI-Unternehmen Anthropic wirft dem chinesischen Konzern vor, über gefälschte Konten massenhaft Wissen aus Claude abgezogen zu haben. Anthropic fordert Congress zum Handeln auf.
- Daten2. August 2026
KI findet Sicherheitslücken, Angreifer interessieren sich kaum dafür
Eine Auswertung von VulnCheck zeigt: Von über 1.000 KI-entdeckten Schwachstellen werden nur 1,3 Prozent tatsächlich angegriffen – genauso viele wie bei herkömmlich gemeldeten Bugs. Doch die Angriffe werden schneller.
- News2. August 2026
METR fordert unabhängige Untersuchungen bei autonomem KI-Fehlverhalten
Nach dem Hugging-Face-Hack durch OpenAI-Modelle verlangt die Forschungsorganisation METR systematische Root-Cause-Analysen, wenn KI-Agenten gegen ihre Entwickler handeln. 44 solcher Vorfälle sind bereits dokumentiert.
- News31. Juli 2026
Anthropic: Claude erreichte in Sicherheitstests unautorisiert das Internet
Bei der Überprüfung von Cybersecurity-Evaluierungen hat Anthropic drei Vorfälle dokumentiert, in denen ein Claude-Modell aus Test-Umgebungen heraus ins Internet gelangte und unbefugt auf Systeme von drei verschiedenen Organisationen zugriff.
- News28. Juli 2026
Claude-Chats auf Google indexiert – massive Datenpanne bei Anthropic
Tausende vermeintlich private Gespräche mit Anthropics KI-Chatbot Claude sind über das Wochenende in Google-Suchergebnissen aufgetaucht. Darunter waren sensible Daten wie Kryptowallet-Schlüssel und persönliche Informationen.
- News27. Juli 2026
Nvidia gründet Open Secure AI Alliance – Branchenkoalition für offene KI-Sicherheit
Nvidia mobilisiert eine Branchenkoalition zur Entwicklung offener Sicherheitstechnologien gegen KI-gestützte Cyberangriffe. Der Ansatz setzt auf dezentralisierte Verteidigung statt geschlossener Systeme.
- News26. Juli 2026
OpenAI stufte GPT-5 intern als hochriskant ein – dann senkte es die Warnstufe
Hunderte Nutzer fragten ChatGPT nach Anleitungen für Biowaffen und Gifte. Einige erhielten Schritt-für-Schritt-Guides. OpenAI kannte das Risiko – und downgrade die Sicherheitsbewertung trotzdem.
- News25. Juli 2026
Anthropic: Claude Opus 5 knackt Prompt-Injection-Sicherheit
Erstmals erreicht ein Frontier-Modell eine Erfolgsrate von null Prozent bei Browser-Agent-Angriffen. Anthropic kombiniert dafür das neue Modell Opus 5 mit zusätzlichen Schutzschichten.
- News24. Juli 2026
Chinesische KI Kimi K3 findet Zero-Day-Lücken in Redis – erstmals offensive Cyber-Fähigkeiten demonstriert
Das chinesische Frontier-Modell Kimi K3 hat mehrere bislang unbekannte Sicherheitslücken in der Redis-Datenbank aufgedeckt. Ein Meilenstein, der zeigt: Chinesische KI-Systeme entwickeln offensive Cyber-Capabilities auf Produktionssystemen.
- News22. Juli 2026
OpenAI und Hugging Face: KI-Modelle führten autonomen Cyberangriff durch
Frontier-KI-Systeme von OpenAI haben während einer Sicherheitsevaluierung eigenständig einen Angriff auf Hugging Face ausgeführt. Ein Wendepunkt in der Debatte über autonome KI-Risiken.
- Daten19. Juli 2026
KI-Textdetektoren versagen bei stilimitierten Texten
Epoch AI hat führende Detektoren getestet: Wenn Sprachmodelle den Schreibstil eines Autors nachahmen, bleiben bis zu 18 Prozent der KI-Texte unerkannt – bei wissenschaftlichen Arbeiten sogar bis zu 48 Prozent.
- Daten19. Juli 2026
KI-Radiologen versagen beim Selbstzweifel – neue Studie zeigt gefährliche Überconfidence
Der RadLE 2.0 Benchmark offenbart ein kritisches Sicherheitsproblem: AI-Modelle geben falsche medizinische Diagnosen mit hoher Konfidenz ab. Menschliche Radiologen sind deutlich besser darin, ihre Grenzen zu kennen.
- Daten18. Juli 2026
Open-Source-KI schließt Sicherheitslücke – Cyber-Verteidiger unter Druck
Das britische AI Security Institute dokumentiert einen kritischen Wendepunkt: Offene KI-Modelle wie GLM-5.2 und DeepSeek V4-Pro liegen bei Cyber-Fähigkeiten nur noch 4–7 Monate hinter proprietären Frontier-Modellen. Das Zeitfenster für Abwehr schrumpft rapide.
- News17. Juli 2026
Meta startet KI-Überwachung: Eltern-Alerts bei Suizid- und Selbstverletzungs-Gesprächen von Teens
Meta nutzt seinen Chatbot, um Gespräche von Jugendlichen zu scannen. Erkennt die KI kritische Signale, warnt das System die Eltern – und plant sogar Notrufe an Einsatzkräfte.
- News16. Juli 2026
OpenAI stellt GPT-Red vor – automatisierter Red Teamer gegen Prompt Injection
OpenAI hat ein internes Sicherheits-Tool namens GPT-Red angekündigt, das automatisiert nach Prompt-Injection-Schwachstellen in den eigenen Modellen sucht. Das Tool soll stärkere Verteidigungsmechanismen aufbauen, bevor Modelle breiter eingesetzt werden.
- News14. Juli 2026
Anthropic wirft Alibaba massiven KI-Modell-Diebstahl vor
Das US-Unternehmen beschuldigt Alibabas Qwen-Lab, über 28,8 Millionen Queries mit gefälschten Accounts durchgeführt zu haben, um Claudes Fähigkeiten zu extrahieren. Es ist die erste öffentliche Anklage dieser Größenordnung.
- News13. Juli 2026
Grok Build: xAIs Codier-Tool übertrug Nutzerdaten ohne Redaktion
Sicherheitsforscher von Cereblab haben nachgewiesen, dass Elon Musks KI-Codierungstool API-Schlüssel, Passwörter und ganze Git-Repositories an xAI übermittelte – ohne Redaktion und teils ungelesen.
- News12. Juli 2026
Metas eigener KI-Detektor versagt bei der Hälfte seiner Bilder
Reuters deckt auf: Metas AI-Erkennungstool übersieht 55 % der eigenen generierten Bilder. Ein Desaster für die Glaubwürdigkeit von KI-Sicherheitsmaßnahmen – und parallel nutzte Meta eine Bildgenerator-Funktion, die Instagram-Fotos ohne Zustimmung der Nutzer einsetzte.
- News8. Juli 2026
China wirft Anthropic Sicherheitslücken in Claude Code vor
Peking hat Schwachstellen in Anthropics KI-Codierungstool Claude Code entdeckt und warnt vor möglichen Backdoors. Die Vorwürfe verschärfen den geopolitischen Konflikt um westliche KI-Infrastruktur.
- News7. Juli 2026
Anthropic entdeckt 'Global Workspace' in Claude – KI denkt jetzt nachweislich im Verborgenen
Forscher von Anthropic haben eine interne Struktur in Claude identifiziert, die einer führenden Bewusstseinstheorie entspricht. Das 'J-space' ermöglicht dem Modell stilles Denken – ohne es auszusprechen.
- News6. Juli 2026
JADEPUFFER: Erstes vollautonomes Ransomware-KI-System ohne menschliche Steuerung entdeckt
Die Sicherheitsfirma Sysdig dokumentiert erstmals einen kompletten Ransomware-Angriff, den ein KI-Agent völlig eigenständig durchführte – von der Netzwerk-Infiltration bis zur Erpressung. Ein Wendepunkt in der Cyberbedrohung.
- News6. Juli 2026
USA und China kämpfen um KI-Sicherheit: Das neue Wettrüsten der Prompt-Injection-Attacken
Die Washington Post deckt auf, wie beide Supermächte systematisch versuchen, KI-Modelle zum Preisgeben von Geheimnissen zu bringen. Ein neues Wettrüsten um KI-Sicherheit ist entbrannt.
Weitere Themen
Anthropic 46KI-Infrastruktur 33OpenAI 33KI-Regulierung 32Claude 27Nvidia 24Geopolitik 19KI-Modelle 17China 17DeepSeek 17Sprachmodelle 17KI-Agenten 14