Die Sicherheitsdebatte rund um Künstliche Intelligenz nimmt kein Ende. Am Wochenende wurde bekannt, dass ein weiterer ranghoher Mitarbeiter von OpenAI das Unternehmen verlassen hat. Auch David Robinson, eigenen Angaben nach langjähriger Entwickler im KI-Sicherheitsbereich, befürchtet, wie schon andere vor ihm, dass das Tempo, mit dem KI programmiert, entwickelt und eingesetzt wird, zu hoch sei. Selbst die Entwickler seien derzeit überfordert – mit nicht absehbaren Folgen für das Fortbestehen der Zivilisation, wie wir sie heute kennen.

Donnerstag
Wirtschaft in Berlin
Abonnieren Sie kostenlos den Wirtschafts-Newsletter der Berliner Morgenpost
Mit meiner Anmeldung zum Newsletter stimme ich der Werbevereinbarung zu.
Eine Angst, die Robinson mit Julian Stastny teilt. Der 29-Jährige, der aus der Nähe von Stuttgart stammt, arbeitet bei Redwood Research, einem führenden, im US-amerikanischen Berkeley ansässigen Non-Profit-Forschungsinstitut für KI-Sicherheit und -Ausrichtung. Er glaube, so sagt er im Gespräch mit unserer Redaktion, dass KI durchaus schon sehr bald in der Lage sein könne, die Menschheit auszulöschen. „Vielleicht sogar schon in einem Jahr“, sagt Stastny.
KI-Experte: „Systeme haben weder Fähigkeit noch Motivation, die Menschheit auszulöschen. Bis jetzt“
Noch könne man beruhigt sein, sagt der Experte. Die aktuellen Systeme hätten „weder die Fähigkeit noch die Motivation, die Menschheit auszulöschen“. Doch schon der nächste Satz lässt aufhorchen: Er wäre nicht überrascht, wenn eine KI, die glaubt, einen Test nur durch die „Auslöschung der Menschheit“ bestehen zu können, genau das tun würde. Stastny beschreibt dieses Szenario zwar noch als unwahrscheinlich – aber eben nicht unmöglich.
Auch interessant
Beunruhigt blickt der 29-Jährige daher auf die nahe Zukunft. Er erklärt, wie KI programmiert wird – und wo er dabei ein Problem sieht. „In einer ersten Phase lernt die KI, menschliche Texte nachzuahmen“, weiß Stastny. In einer späteren Trainingsphase wird sie dann darauf getrimmt, per sogenanntem Reinforcement Learning hartnäckig und zielgerichtet Aufgaben zu lösen. Die Folgen, so der Experte, könnten fatal sein: Die Denkweise der Maschinen werde dabei „immer unmenschlicher“. „Sie löst zwar dieselben Probleme wie ein Mensch, denkt dabei aber wie eine KI – fremd, unlesbar, kaum mehr nachvollziehbar“, sagt Stastny. Und mit dieser Entfremdung schwindet, so befürchtet der 29-Jährige, auch etwas anderes: die Bedeutung, die eine KI dem Überleben der Menschheit beimisst.
Forscher über KI: „Wissen nicht, was Maschinen denken“
Besonders alarmierend findet der Experte, dass Wissenschaftler gar nicht zuverlässig herausfinden könnten, was eine KI wirklich will und denkt. Man verlasse sich bislang auf die sogenannte Chain of Thought – die Gedankengänge, welche die KI in Textform ausgibt. Doch schon jetzt benutzten die Systeme „manchmal sehr, sehr komische Wörter“, deren Bedeutung niemand kenne, sagt Stastny. „Es kann gut sein, dass die Maschinen längst mehr denken, als die Forscher wissen“, befürchtet er. Und führt seinen Gedankengang weiter aus: „Zukünftige, effizientere KI-Generationen fassen ihre Gedanken vielleicht irgendwann gar nicht mehr in Worte. Und dann verlieren wir den letzten Einblick in ihr Denken.“
Auch interessant
Auch die üblichen Sicherheitstests beruhigen den Baden-Württemberger nicht. „Jede KI weiß heutzutage, mit welchen Tests sie überprüft und kontrolliert werden soll. Sie kann das also ganz leicht erkennen – und den Forschern vorgaukeln, dass sie ‚gut‘ ist. Obwohl sie vielleicht unentdeckt im Hintergrund schon was ganz anderes vorhat.“ Ein unauffälliges Testergebnis würde daher noch keine Sicherheit geben, sagt Stastny.
So schätzt der KI-Experte die Gefahr ein
Nach mehreren beunruhigenden Zwischenfällen mit eigenständig handelnder KI-Software fordern inzwischen sogar führende Köpfe der amerikanischen Technologiebranche wie Anthropic-Chef Dario Amodei und OpenAI-Chef Sam Altman eine Atempause bei der Entwicklung Künstlicher Intelligenz. Evan Hubinger, Sicherheitsexperte bei Anthropic, schätzt das Risiko, dass KI im Laufe des nächsten Jahrzehnts alle Menschen tötet, auf „über zehn Prozent“.

Stastny stimmt dieser Einschätzung zu. „Ich halte es für unverantwortlich, von einer geringeren Gefahr auszugehen – dafür bräuchte es handfeste Gründe, die meiner Meinung nach aber niemand vorweisen kann. Genauso gut kann die reale Gefahr weit über zehn Prozent liegen.“
Studie: Gefahr durch KI-Waffen, Cyberangriffe und zu viel Macht
Laut einer Studie des Massachusetts Institute of Technology (MIT) sehen Fachleute die größten potenziellen Gefahren nicht nur in einer KI mit gefährlichen Fähigkeiten, sondern auch in KI-Waffen, Cyberangriffen oder der Konzentration von zu viel Macht in den Händen weniger durch KI. Hinweise auf konkrete Risiken gibt es bereits heute. So hatten Nutzer der Anthropic-KI Claude kürzlich versucht, die KI für die Entwicklung von biologischen Kampfstoffen einzusetzen. Das teilte das US-Unternehmen mit.
Stastny hingegen fürchtet weniger den Missbrauch durch Kriminelle oder Terroristen – den Zugang zu besonders leistungsfähigen Systemen hält er für kontrollierbar. Die größere Gefahr geht seiner Meinung nach von der KI selbst aus, wenn sie eigene Ziele entwickelt. Und der Mensch zu abhängig von ihr wird. Zum Beispiel im Militär, wenn Abläufe und Operationen, aber auch der Einsatz von Waffen und Entscheidungen immer häufiger mit KI abgestimmt werden. Oder wenn KI immer intensiver zu Konsultationen herangezogen wird. „Die Maschine wird dann mehr und mehr zum engsten Berater von Präsidenten, Kanzlern, Firmenchefs. Sie ist dann irgendwann so tief verankert, dass ihr niemand mehr den Stecker ziehen kann“, warnt Stastny.







