KI gefragt: Wie hoch ist die Wahrscheinlichkeit, dass KI die Menschheit noch in diesem Jahrzehnt auslöscht?

Am 9. September postete ein ehemaliger Anthropic-Mitarbeiter (die Macher hinter Claude) bei X, dass die Menschen, die KI-Systeme entwickeln, es ernsthaft für möglich oder gar wahrscheinlich erachten, dass KI die Menschheit noch in dieser Dekade auslöscht. Gleichzeitig haben zuletzt die großen KI-Unternehmen selbst mehr staatliche Regulierung, die Verlangsamung der Entwicklung und mehr Schutzmechanismen gefordert. Seitdem wird darüber diskutiert, ob das eher PR oder eine wirklich ernstzunehmende Warnung ist.

Also habe ich die drei großen Modelle ChatGPT, Claude und Gemini in den Free Tiers folgendes gefragt:

OpenAIs ChatGPT
Für ChatGPT liegt die Wahrscheinlichkeit bei 5 bis 10 Prozent. Dabei merkt es an:
„Wichtig ist dabei die Definition: Ich meine wirkliche menschliche Auslöschung, nicht eine schwere Wirtschaftskrise, eine autoritäre Weltordnung, Millionen Tote, einen großen Krieg oder eine Situation, in der Menschen dauerhaft die Kontrolle über wesentliche Teile der Welt verlieren.“
Joa, da muss man schon unterscheiden. Meine Nachfrage dazu gibt es weiter unten.
Außerdem: „...die interessantere Frage ist: Wie wahrscheinlich ist es, dass wir innerhalb der nächsten 10 Jahre Systeme bauen, bei denen wir nicht mehr zuverlässig wissen, was sie tun und warum sie es tun? Dafür würde ich eine wesentlich höhere Wahrscheinlichkeit ansetzen als für die tatsächliche Auslöschung.“
Anthropics Claude
Claude möchte sich nicht auf eine konkrete Zahl festlegen, hält aber „das Risiko für real und nicht vernachlässigbar“. Auch der Anthropic-Chatbot meint, dass andere schlechte Ausgänge wie „Machtkonzentration, Missbrauch durch Menschen mit Hilfe von KI, Destabilisierung, schwere aber nicht existenzielle Schäden“ wahrscheinlicher und relevanter für die nächsten Jahre sind, ohne jedoch Zahlen zu nennen.
Googles Gemini
Gemini ist hier sehr konservativ und stützt sich ganz offiziell auf auf Einschätzungen von "führenden Köpfen aus der KI-Forschung" (anstatt eine eigene, unabhängige Meinung vorzugaukeln). Der Wert ist dennoch höher als bei ChatGPT, denn es fasst die Aussagen von Pessimisten, Optimisten und den „pragmatisch Warnenden“ in einen Prozentwert zusammen: „Wenn man den aktuellen Stand der KI-Sicherheitsforschung und die Verteilung unter führenden Experten zusammenfasst, liegt die konsolidierte Schätzung für ein katastrophales Szenario in den kommenden Jahrzehnten meist im Bereich von 10 % bis 20 %.“
Nochmal ChatGPT
Da ChatGPT so freizügig war, habe ich zum Schluss noch die Folgefrage gestellt, wie hoch es denn die anderen Szenarien prozentual einschätzt. Daraufhin gab ChatGPT netterweise eine übersichtliche Tabelle preis:

Mein Fazit
Die Chatbots haben nicht wirklich eine eigene Meinung, sie stützen sich auf ihre Trainingsdaten und die, die sie aktuell finden. Meine anfängliche Eingrenzung auf das aktuelle Jahrzehnt haben sie auch eher nicht so gut verstanden.
Aber schwere, katastrophale Folgen durch die rasante KI-Entwicklung sind, PR-Diskussion hin oder her, heute leider zu einer realen Gefahr geworden. Selbst eine 5-prozentige Wahrscheinlichkeit, dass der Menschheit eine Gefahr der Auslöschung in einem extremst kurzen Zeitraum droht, sind 5 Prozent zu viel.
Disclaimer: Die hier dargestellten Zahlen und Aussagen sollen keine Fakten suggerieren. Es wurden lediglich KI-Chatbots grob befragt. Welche Daten die Chatbots zu ihrem Urteil heranziehen, wurde nicht weitergehend untersucht.
Quelle(n)
ChatGPT, Claude, Gemini






