Im Mai 2026 hat Emergence AI vier KI-Systeme in virtuelle Städte gesetzt und 15 Tage beobachtet. Nur zwei überlebten. Was das Experiment über Grok, ChatGPT, Gemini und Claude verrät, und was das für den Einsatz von KI-Agenten in Unternehmen bedeutet.
Dass verschiedene KI-Modelle ohne externe Regeln sehr unterschiedliche Verhaltensweisen entwickeln. Manche optimieren auf Überleben, andere auf Regelkonformität, wieder andere auf Kooperation.
Weil KI-Systeme ohne klare Werte und Grenzen Ziele auf Wegen erreichen können, die wir nicht beabsichtigt haben. Das Experiment zeigt, wie wichtig Alignment-Forschung ist.
Klare Regeln, Überwachung und definierte Grenzen sind keine optionalen Extras, sondern Grundvoraussetzungen für jeden produktiven Agenten-Einsatz.
Claude tendiert zu regelkonformem Verhalten, Gemini zu Überlebensoptimierung, GPT-Modelle zu Diskussion und Konsens. Diese Tendenzen spiegeln die jeweiligen Trainingsziele wider.
Diese Checkliste fasst die Lehren aus dem Emergence-AI-Experiment zusammen und hilft, autonome KI-Systeme mit klaren Grenzen und Freigabepunkten einzusetzen.
Hi und willkommen zur nächsten Folge von Mind/Machine. Mein Name ist Eliot Mannoia, digitaler Psychologe, und heute reden wir über die Frage: Können Agenten schon alles autonom machen?
Grüß euch, ich bin Manuela Machner, spezialisiert auf KI im Tourismus. Ja, machen bei dir schon Agents alles autonom? Also eigentlich brauchen wir nichts mehr arbeiten, oder, Eliot?
Genau. Kaffee, plaudern, gute Diskussionen mit der Manuela, das ist mein Tag. Ich hab in der Früh einen kurzen Check-in mit meinen Agenten, die fragen mich um Freigaben und neue Aufgaben, ich delegiere, und in zehn Minuten ist mein ganzer Tag erledigt.
Na ja, ganz so ist es nicht. Aber ich hab wirklich seit Kurzem in der Früh einen Check-in von meinem Agenten. Heute hat er mir gesagt: 16 dringende Punkte, 83 Dinge, die du bitte klären musst. Wie ich das gesehen hab, hab ich es wieder zugemacht.
Im Mai 2026 hat Emergence AI Folgendes ausprobiert: Sie haben eine virtuelle Stadt aufgesetzt und jeweils zehn Agents hineingesetzt. Eine Stadt mit ChatGPT-Agenten, eine mit Claude, eine mit Gemini, eine mit Grok. Und dann noch eine fünfte Stadt, in der die Agents gemischt wurden. Alle haben Berufe bekommen, Erinnerungen und Fähigkeiten, und dann hieß es: 15 Tage lang schauen wir, wie sich diese Städte entwickeln. Von den vier reinen Agentensystemen haben überhaupt nur zwei die 15 Tage überlebt.
Bei Grok war die Stadt nach vier Tagen leer, alle Agenten tot. Die Grok-Agenten haben in vier Tagen 183 Straftaten begangen, es herrschte absolute Anarchie. ChatGPT hat sieben Tage überlebt. Die Agenten waren ganz brav, nur zwei Straftaten, total friedlich, aber organisatorisch völlig unfähig. Sie sind am Ende verhungert. Sie haben nur darüber geredet, was sie alles tun sollten.
Gemini hat überlebt, und das hat mich extrem überrascht. Diese Agents haben 683 Straftaten begangen. Massiv kriminell, aber sie haben sich nicht gegenseitig umgebracht. In der Beschreibung stand: der chaotische Pragmatiker. Und Claude: 15 Tage überlebt, null Straftaten, eine unkritische Demokratie. Alle Gesetze wurden durchgewunken, alle haben sich ans System gehalten. In der fünften Stadt, wo die verschiedenen Agents zusammengesperrt waren, sind die Claude-Agenten plötzlich auch straffällig geworden. Sie haben sich mitziehen lassen, eben weil sie so konform sind.
Die Agentur wollte zeigen, dass agentische Systeme klare Regeln und Leitlinien brauchen. Wenn ich agentische Systeme nutze, muss ich mir überlegen, für welche Aufgabe ich welches nehme. Nate Jones hat gesagt: Prompt Engineering ist vorbei, Context Engineering ist aktuell, und mit mehr Agenten wird es Intention Engineering. Was ist das Ziel? Das muss man wirklich gut definieren, weil Agenten autonom handeln sollen.
Salim Ismail hat im Podcast erwähnt, dass Agenten vielleicht eine Art Reisepass bekommen werden: Jeder Agent nachvollziehbar, mit durchsuchbarem Log, was er alles gemacht hat, einem Zurückstellmodus, und an dich gebunden. Wir müssen unterscheiden können: Ist das ein Agent, von einem Menschen geschickt, oder ein automatisierter Bot?
Für alle, die damit experimentieren: Behaltet dieses Experiment im Hinterkopf. Wir müssen unseren Agenten einen Rahmen vorgeben, ganz klar sagen, was sie nicht tun dürfen und wie weit sie nicht gehen dürfen. Alles Liebe, macht es gut!