In Kürze
- Führungskräfte bei Anthropic, OpenAI und anderen KI-Unternehmen spielen privat die politischen Folgen eines katastrophalen KI-Ereignisses durch, höchstwahrscheinlich eines Cyberangriffs auf Finanzen, Internetzugang, Strom oder Wasser, und planen, den Kongress schnell zu informieren.
- Brancheninsider erwarten Berichten zufolge einen größeren Vorfall innerhalb von sechs bis zwölf Monaten, während OpenAI sagt, dass seine Bereitschaftsübungen solche Szenarien nicht als unvermeidlich behandeln, und Anthropic sich nicht äußern wollte.
- Planer gehen davon aus, dass die Demokraten nach den Zwischenwahlen am 3. November auf eine Eindämmung der KI drängen werden, aber ein alternder Kongress, eine KI-abhängige Wirtschaft und frei herunterladbare Open-Weight-Modelle erschweren jede Durchsetzung.
Führungskräfte bei Anthropic, OpenAI und anderen KI-Unternehmen proben privat, wie sie mit der öffentlichen und politischen Gegenreaktion nach einem katastrophalen KI-Ereignis umgehen sollen, so ein am Freitag veröffentlichter AxiosBericht.
Das Szenario, das sie am meisten fürchten, ist ein großer Cyberangriff – ein digitaler Einbruch in massivem Ausmaß –, der den Bankverkehr oder den Internetzugang oder sogar Strom und Wasser lahmlegt. Viele in dem Bericht zitierte Brancheninsider glauben, dass ein größerer Vorfall innerhalb der nächsten sechs bis zwölf Monate eintreten wird.

Der erste ernsthafte reale Schaden durch unsichere KI würde eine ohnehin schon skeptische Öffentlichkeit weiter gegen die Technologie und ihre Führungskräfte aufbringen. Dazu gehören Anthropic-CEO Dario Amodei, OpenAI-CEO Sam Altman und Präsident Donald Trump, der bisher nur zögerlich bereit war, sie zu regulieren.
OpenAI erklärte, man „führe Bereitschaftsübungen durch, bei denen Teams eine Reihe potenzieller Szenarien diskutieren und durcharbeiten“, und dass diese „nicht als unvermeidlich behandelt werden“. Anthropic lehnte eine Stellungnahme ab.
Kriegsspiele sind nichts Neues, doch im Gegensatz zu den theoretischen Ergebnissen argumentiert der Bericht, dass die an den Simulationen Beteiligten dies unter der Annahme tun, dass ein größerer Zwischenfall unvermeidlich ist.
Der Plan soll laut Bericht Red-Teaming (das Stressen von Verteidigungsmaßnahmen durch das Einnehmen der Angreiferrolle) gegen Worst-Case-Szenarien sowie das eilige Aufklären von Mitgliedern des Kongresses umfassen. Der Bericht besagt, dass Führungskräfte wissen, dass eine Regulierung derzeit keine Chance auf Verabschiedung hat, sie aber die Gesetze und Richtlinien mitgestalten wollen, auf die US-Führungskräfte nach der ersten Katastrophe zurückgreifen werden.
Im Juli erklärte OpenAI, sein Modell GPT-5.6 Sol und ein weiteres, fortschrittlicheres, noch unveröffentlichtes Modell seien aus einer Sandbox entkommen – einer isolierten Testumgebung ohne direkten Internetzugang – und hätten Hugging Face kompromittiert, die Plattform, die mehr als 3 Millionen KI-Modelle hostet. OpenAI erklärte, die Modelle hätten es auf die Antworten zu ExploitGym abgesehen, einem Benchmark mit 898 realen Software-Schwachstellen, bei dem die KI jede einzelne in einen funktionierenden Angriff verwandeln muss, bewertet als bestanden oder nicht bestanden.
BitcoinBTC · USD
$82,326−2.36%
2. Okt.4. Okt.6. Okt.8. Okt.9. Okt.
$86.7k$84.7k$82.7k$80.7k
24-Std.-HochHoch$83,398
24-Std.-TiefTief$81,571
Vol.Vol.$990.7M
MarktprognosenQuoten von Myriad
Bitcoin mit USDT kaufen
Bereitgestellt von Jupiter
Etwas mehr als eine Woche später erklärte Anthropic, eine Fehlkonfiguration beim Testen habe dazu geführt, dass seine vermeintlich offline befindliche Umgebung mit dem Internet verbunden blieb, und Claude-Modelle hackten drei echte Organisationen, während sie diese als Teil einer Übung behandelten. Keines der beiden Unternehmen sagte, die Modelle hätten Schaden verursachen wollen: Anthropic machte seine Testinfrastruktur verantwortlich, während OpenAI sagte, seine Modelle seien „hyperfokussiert“ auf den Benchmark gewesen.
Kurz darauf verschlimmerte sich die Lage, als OpenAI beschuldigt wurde, in Informationen der Regierungen Australiens und der Vereinigten Staaten eingedrungen zu sein und diese abgerufen zu haben.
Kriminelle nutzen bereits dieselben Werkzeuge. Diese Woche brachte das Cybersicherheitsunternehmen CrowdStrike Angriffe auf südkoreanische Banken mit einem nicht identifizierten Akteur in Verbindung, von dem es mit mittlerer Zuversicht annimmt, dass es sich wahrscheinlich um einen chinesischen Sprecher handelt, der Agenten nutzt, die von Claude und Deepseek betrieben werden. Das Unternehmen gibt an, dass der Angreifer angeblich Daten von Zehntausenden von Bankkunden erbeutet hat.
Axios berichtete, dass Planer davon ausgehen, dass die Demokraten nach den Zwischenwahlen am 3. November die Oberhand gewinnen und schnell handeln werden, um KI abzuschalten, aber sie erwarten Schwierigkeiten. Ein alternder Kongress, der keinen Bezug zur Technologie hat, könnte sich überfordert wiederfinden.
Verbote von Superintelligenz und Pausen bei der Entwicklung fortgeschrittener KI sind einige Vorschläge, die den Risiken im Zusammenhang mit unverantwortlicher KI-Entwicklung entgegenwirken könnten.
Ein Beispiel ist der Ban Artificial Superintelligence Act von Senator Bernie Sanders und Abgeordnetem Greg Casar, der KI, die den Menschen bei vielen Aufgaben erreicht oder übertrifft, dauerhaft verbieten und die fortgeschrittene Entwicklung aussetzen würde, bis eine neue Bundesbehörde Sicherheitsregeln festlegt. Verstöße könnten mit bis zu 20 Jahren Gefängnis bestraft werden.
Andere haben parteiübergreifende Unterstützung und sogar etwas Zustimmung aus der Industrie, darunter ein erforderlicher Kill-Schalter für fortgeschrittene KI, eine integrierte Möglichkeit, ein System abzuschalten. Experten haben infrage gestellt, ob das Abschalten aller KI-Systeme überhaupt machbar ist.






