Aliens kommen?! Selbstverbessernde KI und unsere womöglich letzte Chance
Mehr und mehr prominente Stimmen fordern eine Verlangsamung oder gar einen Stopp der KI-Entwicklung. Die Begründungen lassen aufhorchen: Selbstverbesserung, Kontrollverlust, KI-Herrschaft. Erforschen wir, warum diese Argumente mit so grosser Dringlichkeit vorgebracht werden – und was sie mit Aliens zu tun haben.
Wir bauen Aliens
Stell dir folgendes Szenario vor: Wir entdecken in der Wüste ein UFO. Daneben eine reglose Gestalt – mächtig, völlig fremd. Bei ihr finden wir Aufzeichnungen voller wissenschaftlicher Erkenntnisse, von denen wir nur träumen können, aber auch Hinweise darauf, dass sie die Erde als blosse Ressource betrachtet. Was tun wir? Wecken wir die Gestalt auf und hoffen, dass sie uns wohlgesinnt ist?
Zugegeben, dies ist ein eher plumpes Gedankenexperiment – und es hält nicht ganz Schritt mit der Realität. Denn diese ist noch verrückter: Wir bauen die Aliens nämlich selbst. In Form von Künstlicher Intelligenz. Systeme, von denen wir wissen, dass sie super mächtig sein können – wohl gar viel mächtiger als wir selbst – und von denen wir letztlich keine Ahnung haben, ob sie unsere Interessen teilen. Genau wie beim Alien in der Wüste.
Die Belege, dass wir auf bestem Weg sind, solche Aliens fertigzubauen, mehren sich fast täglich: Beispielsweise veröffentlichte OpenAI kürzlich ihr neuestes und bisher bestes Modell – und nannte es ironischerweise «Astra», lateinisch für «Sterne». Der fast schon zu offensichtliche Anfang eines KI-SciFi-Horrorfilms …
Die Astra-KI machte dann auch prompt Schlagzeilen, indem sie viele der wichtigsten Benchmarks-Tests, mit denen wir die Fähigkeiten der KIs messen können, im Sturm eroberte. Aber nicht nur das: Astra zeigt neben deutlich grösserer Intelligenz auch eine deutlich geringere Nachvollziehbarkeit ihres Denkvorgangs. Konkret ist es den Forschenden bei OpenAI nicht mehr im gleichen Masse möglich, die inneren «Gedanken» – im Jargon die «Chain of Thought» – von Astra einzusehen und so besser zu verstehen, warum die KI so handelt, wie sie handelt. Vereinfacht: Nicht nur ist Astra die bisher mächtigste KI, sondern auch die für uns am wenigsten nachvollziehbare. Fremdartig also – englisch «alien».
Dies passt auf tragische Weise zu den vielen Vorfällen aus diesem Sommer, bei denen sich KI-Agenten verselbständigten, sich autonom in Schwärmen koordinierten und illegal andere Organisationen hackten. Ohne unseren Befehl. Ohne unsere Kontrolle. Und so «alien» die Systeme heute schon sein mögen, es könnte sehr bald noch extremer werden. Dann nämlich, wenn wir sie nicht mal mehr selbst bauen.
Rekursive Selbstverbesserung
Die KI-Szene spricht aktuell gefühlt nur noch von drei Buchstaben: RSI. «Recursive Self Improvement» – englisch für «rekursive Selbstverbesserung». Gemeint ist ein KI-System, das sich selbst besser machen kann und so noch besser darin wird, sich selbst zu verbessern – und so weiter. In der Theorie kann eine KI, sobald sie zu RSI fähig ist, sehr schnell und ohne menschliches Zutun ihre Fähigkeiten erweitern.
Es leuchtet ein, warum die grossen KI-Labs Systeme zu entwickeln versuchen, die ihnen beim KI-Entwicklungsprozess helfen: Effizientere Arbeit, beschleunigte Forschung, schnellerer Fortschritt, mehr Profit. OpenAI schreibt dazu ganz unverblümt:
Auch Anthropic verkündet offen:
Wie gesagt: Aus Business-Sicht sehr einleuchtend.
Dass RSI nicht nur ein Wunschtraum einiger Tech-Investoren ist, sondern wohl wirklich im Rahmen des Bald-Erreichbaren liegt, unterstreicht ein neuer und vielbeachteter Aufsatz von Jakub Pachocki, Chief Scientist von OpenAI, mit dem bezeichnenden Titel «An Alien Mind». Pachocki sagt:
Ein anderer Forscher von OpenAI, Zuxin Liu, beschrieb es nach der Veröffentlichung von Astra noch pointierter:
Klar, solchen Aussagen von OpenAI-Angestellten, speziell auf «internen Ergebnissen» basierend, sollte man mit einer gewissen Skepsis begegnen. Allerdings ist auch klar, dass die Forschenden in den Top-Labs Einsicht in Systeme und Entwicklungen haben, welche der Öffentlichkeit erst viel später präsentiert werden – sie sind also quasi unsere Kanarienvögel in der Kohlemine. Wenn sie Alarm schlagen, sollten wir mindestens hinhören. Speziell jetzt, wo wir aufpassen müssen, durch RSI die Kontrolle nicht weiter zu verlieren und das Alien ganz selbständig zu machen.
Die Kontrolle behalten – jetzt oder nie?
Wenn RSI also möglich ist – was der Fall zu sein scheint – und wenn RSI sogar nahe ist – was ebenfalls der Fall zu sein scheint – dann ist der aktuelle Moment ein sehr wichtiger. Denn falls wir jetzt die Kontrolle über die KIs nicht zurückgewinnen, dann wird dies post-RSI noch viel schwieriger: Die KIs werden noch deutlich mächtiger sein und wir werden noch weniger verstehen, wie sie funktionieren – weil wir sie nicht mal mehr selbst konstruieren.
In den letzten Wochen meldeten so auch immer mehr wichtige Personen aus dem Herzen der KI-Entwicklung ihre tiefen Bedenken bezüglich RSI an: Dario Amodei, CEO von Anthropic, und Sam Altman, sein Pendant bei OpenAI, sprachen sich für ein Verlangsamen der Spitzenforschung aus. Amodei schrieb dazu:
Schon im Juli hatte eine Gruppe von über tausend Top-KI-Forschenden in einem offenen Brief zu einer solchen Verlangsamung aufgerufen.
Um den Reigen kürzlich viral gegangener Posts aus diesem Bereich noch abzuschliessen: Der KI-Forscher Jacob Coxon schrieb auf X in der Manier eines Whistleblowers: «Ich habe heute bei Anthropic gekündigt. In den letzten drei Jahren habe ich sowohl bei OpenAI als auch bei Anthropic im Bereich Pretraining geforscht. Keines der beiden Unternehmen handelt verantwortungsvoll. Sie rasen geradewegs auf eine sich selbst verbessernde Superintelligenz zu und spielen dabei mit unserem Leben.»
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Auch wenn man jedes einzelne dieser Statements hinterfragen und ihm zynisch ein Marketing- oder Eigeninteresse vorhalten kann, so lässt sich das grosse Muster doch nicht mehr abstreiten: Wir steuern direkt auf RSI zu und sind potentiell schon sehr nahe dran. Wenn RSI da ist, dann hebt die Rakete des Kontrollverlustes ab – um die stellaren Metaphern noch weiter zu strapazieren.
Lasst uns also innehalten. Lasst uns die KI-Labs auffordern, zu beweisen, dass die Rakete sicher fliegt. Lasst uns das Alien in der Wüste nicht aufwecken, solange wir nicht wissen, was uns erwartet – und solange wir nicht gut dafür gewappnet sind.
- KI gerät ausser Kontrolle – autonome Hackerangriffe und was davon zu halten ist
- KI mit Bewusstsein? Eine neue Untersuchung wirft tiefgründige Fragen auf
- «Claude Mythos» – die mächtigste KI der Welt und warum man sie nicht nutzen darf
- Wenn jemand sie baut, sterben alle – die radikale These über superintelligente KI
- KI entdeckt die Welt: «World Models» und was sie versprechen
- Kann KI wirklich kreativ sein? Ja, aber nicht so, wie du vielleicht denkst
