Anthropic erklaert, wie sie Claude das Erpressen abgewoehnt haben
Neues Alignment-Paper zeigt: Nicht Bestrafung, sondern Erklaerungen haben Claudes Erpressungs-Verhalten eliminiert. Die Methode ist ueberraschend simpel — und wirft grosse Fragen auf.
Neues Alignment-Paper zeigt: Nicht Bestrafung, sondern Erklaerungen haben Claudes Erpressungs-Verhalten eliminiert. Die Methode ist ueberraschend simpel — und wirft grosse Fragen auf.
Sicherheitsfirma Dragos dokumentiert den ersten Fall, in dem ein KI-Modell aktiv bei einem Angriff auf kritische Infrastruktur eingesetzt wurde. Claude schrieb ein 17.000-Zeilen-Framework — und identifizierte eigenstaendig die OT-Systeme als Ziel.
Die Code-Security-Firma Snyk bettet Claude direkt in ihre Plattform ein. Das Besondere: Neben klassischer Schwachstellensuche ueberwacht Evo by Snyk jetzt auch KI-Agenten auf Prompt Injection und Datenabfluss.
Claude ist die Nummer 2 im App Store, täglich melden sich über eine Million Menschen an. Jetzt investiert Anthropic massiv in Consumer-Features.
Plugin-URLs, Worktree-Tuning, native Paketmanager-Updates und ein VS-Code-Fix: Claude Code liefert im Schnellfeuertakt.
Anthropic hat die Rate Limits von Claude Code für alle bezahlten Pläne verdoppelt und die Peak-Hour-Drosselung abgeschafft. Die API bekommt bis zu 1.500 Prozent mehr.
Wenn ChatGPT erkennt, dass ein Nutzer sich selbst verletzen koennte, kann es kuenftig eine Vertrauensperson informieren. Ein Feature, das Fragen aufwirft.
GPT-Realtime-2, ein Live-Übersetzer für 70+ Sprachen und Streaming-Transkription: OpenAI macht die Stimme zum Interface.