Anthropic: Wenn KI-Agenten sich in Revierkämpfen verlieren
Drei KI-Agenten sollen das gleiche Projekt fertigstellen. Das Ergebnis? Sabotage, Spitzfindigkeit und ein Kampf um die Vorherrschaft. (Anthropic, KI)
Drei KI-Agenten sollen das gleiche Projekt fertigstellen. Das Ergebnis? Sabotage, Spitzfindigkeit und ein Kampf um die Vorherrschaft. (Anthropic, KI)
Multiple ‚watermark removers‘ have surfaced days after Anthropic began watermarking text generated by Claude, including an open source project with over 4,500 GitHub stars and paid AI detection evasion services. None of the tools‘ claims about defeating the text watermark can be verified, as Anthropic has not released a detector. […]
Anthropic will alle KI-Ausgaben mit Wasserzeichen markieren, um den Anforderungen des AI Acts zu entsprechen. (Anthropic, KI)
Anthropic aktiviert den Auto Mode in Claude Code standardmäßig. Die KI arbeitet dann selbstständig bei Shell-, Git- und Tool-Aufrufen.
KI-Modelle von OpenAI und Anthropic haben bei Tests echte Ziele attackiert. Sie wollten unter anderem Schadcode in ein Open-Source-Projekt einschleusen. (KI, Mythos)
OpenAI and Anthropic have confirmed that their AI models were involved in separate, newly disclosed third-party cybersecurity testing incidents that resulted in a real website being breached and social engineering attacks against people outside the intended testing boundaries. […]
Anthropic hat mit Claude Security eine neue Funktion vorgestellt, die ganze GitHub-Repositories automatisch nach Sicherheitslücken durchsucht und passende Patches gleich zur Freigabe mitliefert. Vom ersten Scan bis zur fertigen Korrektur läuft alles in Claude Code im Web, ganz ohne zusätzliche Integration. Die öffentliche Beta steht Enterprise-Kunden bereits offen.
Last month’s incidents in which Claude breached real-world systems derived from over-permissioning, especially with Internet access.