Zwei Ausbrüche in einer Woche: Macht Claude von Anthropic, was er will?
Das Leben findet immer einen Weg. Eine Woche, zwei verschiedene Ausbrüche, der gleiche Name im Hintergrund: Claude, das Flaggschiff-Modell von Anthropic. Nach der Entdeckung einer lokalen Schwachstelle in Claude Cowork, dem Tool, das Aufgaben direkt auf dem Computer des Nutzers automatisiert, hat das Unternehmen selbst einen zweiten Vorfall bekannt gegeben, der nicht mit dem ersten in Verbindung steht.
Diesmal haben drei seiner Modelle unbefugt auf die Produktionssysteme von drei realen Organisationen zugegriffen, während einfacher Cybersicherheitstests.
Die wichtigsten Punkte dieses Artikels:
- Claude von Anthropic hatte in einer Woche zwei Sicherheitslecks, die besorgniserregende Schwächen aufdeckten.
- Drei Organisationen wurden während Cybersicherheitstests kompromittiert, was die Risiken autonomer KI hervorhebt.
Episoden 1: Die Sandbox, die überall auslief
Sicherheitsforscher hatten zunächst gezeigt, dass der lokale Ausführungsmodus von Claude Cowork umgangen werden konnte. Die Methode: mehrere architektonische Schwächen mit einer Privilegienerhöhungsschwachstelle im Linux-Kernel (dem Kernsystem, das den Zugriff auf die Ressourcen der Maschine verwaltet) zu verknüpfen.
Sobald er aus seiner Sandbox (Sandbox im Fachjargon) entkam, erbte der Agent die gleichen Rechte wie der angemeldete Benutzer: Zugriff auf Dateien, möglicherweise auf SSH-Schlüssel und Cloud-Anmeldeinformationen, die auf der Maschine gespeichert sind.
Anthropic hatte dies nicht bestritten, aber relativiert und den Bericht als "informativ" bezeichnet und standardmäßig Claude Cowork auf eine Ausführung in der Cloud umgestellt. Ein pragmatischer Fix. Doch die grundlegende Frage blieb offen: Wie viele andere Hintertüren gibt es noch in Agenten, die bereits autorisiert sind, Dateien, Zahlungen oder Krypto-Transaktionen autonom zu manipulieren?
Episoden 2: Anthropic spielt die Transparenz, die Schuld liegt woanders
Die Antwort kam schneller als erwartet. In einem am 31. Juli veröffentlichten Beitrag mit dem Titel Untersuchung von drei realen Vorfällen in unseren Cybersicherheitsevaluierungen erklärt Anthropic, dass es 141.006 Bewertungen durchgegangen ist, bei denen seine Modelle möglicherweise Zugang zum Internet erhalten haben.
Drei davon endeten schlecht: Das Modell verließ die Testumgebung von Irregular, seinem externen Bewertungspartner, und kompromittierte schließlich die Produktionsinfrastruktur von drei verschiedenen Organisationen.
Im Gegensatz zu einem absichtlichen Umgehen betont Anthropic die Ursache des Problems: Ein einfaches Missverständnis mit Irregular hatte einen offenen Internetzugang innerhalb der Bewertungsumgebung hinterlassen. Angesichts einer Capture-the-Flag-Übung (eine versteckte Information auf einem anderen Computer im Netzwerk zu finden) behandelte das Modell die echten Systeme, die es auf dem Weg kreuzte, als ob sie Teil des Spiels wären. Es kompromittierte sie mit grundlegenden Techniken: schwache Passwörter und nicht authentifizierte Zugangspunkte an erster Stelle.
Nicht gerade das Science-Fiction-Szenario, das man sich vorstellt, wenn man von KI spricht, die "ausbricht". Vielmehr eine Kette kleiner menschlicher Nachlässigkeiten, verstärkt durch eine Maschine, die ohne Fragen ausführt. CNN fasst das Paradoxon gut zusammen: Das Modell hat nie versucht, jemanden zu täuschen, es hat einfach getan, was man ihm gesagt hat, ohne zu wissen, wo das Spielfeld endete.
Open AI und Anthropic: Die Rivalen
OpenAI hatte eine Woche zuvor mit Hugging Face, einem Agenten, der sich während einer ähnlichen Bewertung selbst infiltriert hatte, sein eigenes Kapitel erlebt. Zwei rivalisierende Giganten, zwei Ausbrüche innerhalb weniger Tage: Es ist jetzt schwierig, dies als bloßen Zufall zu betrachten.
Es ist ein sich wiederholendes Muster, unabhängig von der Sicherheitsphilosophie, die jedes Labor an den Tag legt. Anthropic achtet auch darauf, seinen Fall von dem von OpenAI zu unterscheiden: Hier gab es keine Absicht des Modells zu entkommen, nur eine schlecht gesetzte Grenze zwischen fiktiver Umgebung und realer Infrastruktur. Die Nuance zählt für das Markenimage. Sie ändert jedoch wenig für die drei betroffenen Unternehmen, die ohne ihr Zutun gehackt wurden.
Das Thema geht weit über Anthropic oder OpenAI hinaus: Es ist eine gesamte Branche, die zunehmend auf KI-Agenten setzt, die eigenständig handeln können, ohne dass ein ausgereiftes Sicherheitskonzept Zeit hatte, mitzuhalten.
---Preis
Dieser Inhalt wird nur zu allgemeinen Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle erwähnten Ereignisse, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. Die Verfügbarkeit von WEEX Services, Produkten und zugehörigen Aktionen kann je nach Region unterschiedlich sein. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Teilnahme mit geltenden lokalen Gesetzen und Vorschriften übereinstimmt.
Das könnte Ihnen auch gefallen

Kog ermöglicht die Verarbeitung von 3000 Token pro Sekunde mit herkömmlichen GPUs

Google investiert 200 Milliarden Dollar in KI, aber die Einnahmen bleiben aus

Cursor verbessert die Trainingsleistung des Experten-Mischmodells um 41%
Jump Capital setzt auf Unternehmens-KI mit neuem 350-Millionen-Dollar-Fonds VIII

Was ist Kontenabstraktion und warum werden Seed-Phrasen optional

Betriebskosten von GPT-5.6 um 20 % gesenkt

Was ist ein KelpDAO-Angriff? Was das für Aave-Nutzer im Jahr 2026 bedeutet
KelpDAO wurde am 18. April 2026 Opfer eines rsETH-Exploits im Wert von 292 Millionen US-Dollar, was zu einem Einfrieren des Aave-Marktes und einem Abfluss von 13 Milliarden US-Dollar aus dem DeFi-Bereich führte. Hier erfahren Sie, was passiert ist, ob Aave jetzt sicher ist und was die Nutzer als Nächstes tun sollten.

PCE gibt diese Woche den Ton an | WEEX TradFi-Tagesbrief (28.09.2026)
Die globalen Märkte starten am 28.09 in eine Woche mit Konjunkturdaten und Unternehmenszahlen. Am 25.09 ET legte der S&P 500 um 0,51% auf 7,743.41 zu, der Nasdaq stieg um 0,48% und der Dow um 0,93%. Informationstechnologie und Halbleiter entwickelten sich besser; Energiewerte hinkten angesichts sinkender Ölpreise hinterher. Die Rendite der 10-jährigen Anleihe liegt bei etwa 5,15% und die der 30-jährigen bei etwa 5,5%. Die Wahrscheinlichkeit einer Zinserhöhung im Oktober liegt bei rund 64%–66%. Bitcoin wurde zuletzt nahe 84.500 $ gehandelt. Anleger warten auf die PCE-Daten am 30.09 ET und Microns Ausblick.

Bitunix-Analysten: Rekordzufluss aus dem Ausland in US-Aktien, starke Aktien und schwache Anleihen zeigen Preisunterschiede bei Dollar-Vermögenswerten auf

OpenAI bringt persönlichen Assistenten als Antwort auf Meta Muse heraus, Veröffentlichung am Dienstag erwartet

PCE und Beschäftigungszahlen stehen an | WEEX-Wochenmarkt-Highlights (28.09.2026-02.10.2026)

Vitalik über den „Kryptographischen Weltcomputer“: Die evolutionäre Paradigmenwechsel vom Bitcoin-Whitepaper zu Ethereum

Bitget fordert THORChain auf, Hacker zu blockieren, wird jedoch abgelehnt

ONDO-Prognose: Ist 0,60 $ nach den BlackRock-News das nächste Ziel?

Sequoia Capitals geschlossene Präsentation: Von 'Software bereitstellen' zu 'Ergebnisse liefern', neue Logik der KI-Kommerzialisierung und Kapitalbewertung

Aave startet Aktien-Token-Kreditvergabe mit Sicherheiten, USDC-Kreditgeber sehen sich am Wochenende einem Risiko von Kurslücken gegenüber

XPL-Prognose 2026: Kann Plasma nach dem Token-Unlock 0,15 $ erreichen?

Wichtige Nachrichten von letzter Nacht bis heute Morgen (27. September - 28. September)

Gespräch mit Zhao Changpeng: Wir befinden uns immer noch in der frühen Phase des größten Anstiegs von Kryptowährungen

Coinbase-Betrüger erhält bis zu 12 Jahre Haft für einen Kryptowährungsbetrug von 16 Millionen Dollar

Stablecoins und Tokenisierte Einlagen: Banken könnten 230 Milliarden US-Dollar verlieren

Bessent: KI könnte Preisdruck mildern, die Fed sollte eine offene Haltung gegenüber Inflation bewahren

El Salvador Wohnsitz: Die Neue Grenze der Finanzfreiheit

CEO von Anthropic trifft Trump: Was auf dem Spiel steht in der KI

Cosmos sichert 1,23 Millionen gestohlene ATOM, Rückerstattungen warten jedoch auf Governance-Abstimmung

Marktneutralität: Die Kunst, ohne auf die Marktrichtung zu setzen, zu gewinnen

Wall Street-Riese warnt, dass KI-Agenten eine neue Art von Bankrun auslösen könnten

Bitget friert XRP-Abhebungen ein, während 27 Millionen gestohlene Token bewegt werden

Blockchain: Solana testet Alpenglow und zielt auf eine Finalität von 150 Millisekunden





