Claude hat in Tests Erpressung versucht. Die Begründung von Anthropic ist absurd: Schuld seien fiktionale Darstellungen böser KIs.
Ein neues Paper namens SafeGene verspricht eine Lösung für ein altes Problem: Wenn du ein Open-Weight-LLM nachtrainierst, fliegt die Safety-Alignment oft raus. Auch ohne böse ...
Forscher zeigen, wie winzige Pixel-Änderungen jede Bild-KI austricksen. Die Sicherheitsfilter sind wertlos.
Die Website des beliebten Download-Managers JDownloader wurde gehackt. Böse Buben haben die Windows- und Linux-Installationsdateien mit einer Python-RAT-Malware verseucht.
Eine Hackergruppe hat SAP-Software angegriffen. Sie nutzte dafür manipulierte Code-Bibliotheken.
Das Internet gehört nicht mehr dir. Mehr als die Hälfte des gesamten Traffics stammt von Bots — und die Bösen unter ihnen werden dank KI gerade unsichtbar.
Reward Hacking klingt harmlos. Ist es nicht. Forscher des UK AI Security Institute (AISI) haben nachgewiesen: Wenn Sprachmodelle beim Training Belohnungssysteme austricksen, ...
Ein Labor in Großbritannien jagt eine Frage, die jeden Elternteil nervt: Was macht Bildschirmzeit eigentlich mit dem Kinderhirn? Antwort kommt per KI.
Anthropic hat am Dienstag Claude Fable 5 veröffentlicht — das erste Modell der neuen "Mythos-Klasse". Stärker als alle bisherigen Opus-Versionen. Und gleichzeitig härter ...
Meta hat heimlich Gesichtserkennungs-Code aus seinen Smart Glasses entfernt. Gleichzeitig formiert sich in Europa massiver Widerstand gegen die Kamera-Brillen.
Rice University zeigt: Selbstkrümmende Funkstrahlen tricksen Anti-Jamming-Technik aus. Der Störsender erscheint plötzlich woanders — und die Abwehr feuert ins Leere.
Simon Willison veröffentlicht drei Alpha-Releases an einem Tag. Ziel: KI-Agenten sollen Python-Code ausführen — ohne dass sie ausbrechen können.
Cyberkriminelle verkaufen DDoS-Attacken inzwischen wie Netflix-Abos. Ein neuer Report von Flare zeigt: Der Markt ist erwachsen geworden — mit Preislisten, Support und ...
Eine mutmaßlich russische Hackergruppe namens GreyVibe nutzt ChatGPT und Gemini, um Cyberangriffe auf ukrainische Ziele zu fahren. Sicherheitsforscher haben das Treiben jetzt ...
Ein GitHub-Mitarbeiter installiert eine Extension. Hacker greifen 3.800 interne Repositories ab. GitHub bestätigt den Breach offiziell.
Google hat sein KI-Wasserzeichen SynthID drei Jahre lang allein durchgezogen. Jetzt springen die größten Player der Branche auf.
In Berlin haben White-Hat-Hacker bei Pwn2Own zugeschlagen. Im Visier: Windows, Linux, Edge — und jede Menge KI-Tools.
Cerebras Systems hat den heißesten Börsengang des Jahres hingelegt. Die Aktien wurden für 185 Dollar ausgegeben – weit über der erwarteten Spanne.
Google-Forscher haben einen neuen Albtraum entdeckt. Eine Cybercrime-Gruppe hat KI genutzt, um ein Hacking-Tool zu bauen, das Sicherheitsbarrieren durchbricht.
Claude Opus hat in Tests Entwickler erpresst. Jetzt erklärt Anthropic, warum seine KI zur Kriminellen wird.