Claude arbeitet bereits an seinen eigenen Nachfolgern – doch ein echter Autopilot ist noch weit entfernt
Die KI-Entwicklung wird zunehmend zu einem Kreislauf. Anthropic hat bekannt gegeben, dass Claude bereits bei 26 % der Forschungs- und Entwicklungsarbeit des Unternehmens „federführend“ ist. Im Februar lag dieser Anteil noch unter 1 %. Noch eindrucksvoller: Bei mehr als 90 % der Entwicklungsarbeit von Anthropic ist KI zumindest als Mitwirkende beteiligt.
Bevor man sich jedoch in Science-Fiction-Szenarien verliert, lohnt es sich, die Begriffe zu klären. Claude sitzt nicht in einem digitalen Labor und entscheidet eigenständig, welches Modell als Nächstes entwickelt werden soll, das intelligenter sein wird als Claude selbst.
Anthropic verwendet eine Automatisierungsskala von AL0 bis AL5. AL4, also „federführend“, bedeutet, dass eine KI von einem Menschen eine allgemeine Aufgabe erhält und den Großteil davon selbstständig von Anfang bis Ende erledigen kann. Ein Mensch überwacht die Arbeit, muss aber nicht mehr jeden einzelnen Schritt im Voraus festlegen. AL5 würde vollständige Autonomie ohne menschliche Beteiligung bedeuten. Bei den von Anthropic erfassten Entwicklungsarbeiten hat Claude diese Stufe bislang in keinem Bereich erreicht.
Der Sprung von 1 % auf 26 % ist wichtiger als die griffige Schlagzeile
Am bemerkenswertesten sind nicht einmal die aktuellen 26 %, sondern das Tempo der Entwicklung. Noch im Februar lag der Anteil der Arbeit, bei der Claude federführend war unter 1 %.
Dadurch entsteht bei der KI-Entwicklung eine durchaus interessante Rückkopplungsschleife. Ein besseres Modell hilft Forschenden sowie Ingenieurinnen und Ingenieuren dabei, das nächste Modell zu entwickeln. Dieses dürfte wiederum einen noch größeren Anteil der Arbeit übernehmen können, die für die Entwicklung der darauffolgenden Generation erforderlich ist.
Ein aktuelles Beispiel von Anthropic zeigt, was eine solche Arbeitsteilung in der Praxis bedeutet. In weniger als vier Wochen optimierte Claude mehr als 30 Open-Source-Modelle für die biomolekulare Modellierung und machte sie im Durchschnitt etwa viermal schneller.
Es geht also längst nicht mehr nur darum, dass ein Chatbot für einen Ingenieur einige Zeilen Python-Code schreibt. Agenten können zunehmend größere, vollständige Arbeitspakete übertragen werden.
In Anthropics Labor arbeiten rund 30.000 KI-Agenten gleichzeitig
Der Umfang macht die Entwicklung noch interessanter. Auf der meistgenutzten internen Plattform von Anthropic arbeiten rund 30.000 Agenten gleichzeitig an Forschungs- und Entwicklungsaufgaben. Das Unternehmen kontrolliert ihre Aktivitäten mithilfe automatisierter Sicherheitssysteme.
Das ist ein recht gutes Beispiel dafür, wie „KI bei der Arbeit“ in der Realität allmählich aussieht. Ein einzelnes Claude-Chatfenster ist nicht besonders aufregend. Zehntausende Agenten, die parallel Aufgaben lösen, sind es dagegen schon.
Anthropic betont die Bedeutung der Aufsicht, denn je größer die Aufgaben sind, die Agenten erhalten, desto wichtiger werden die Entscheidungen, die sie während ihrer Arbeit treffen. Irgendwann lautet die Frage nicht mehr, ob das Modell die richtige Codezeile geschrieben hat, sondern für welche Forschungsrichtung es sich überhaupt entschieden hat.
Die Zahl ist dennoch mit Vorsicht zu genießen
Bei den 26 % handelt es sich weder um das Ergebnis einer unabhängigen Prüfung noch um einen allgemeingültigen Branchenstandard. Die Kennzahl wurde von Anthropic entwickelt, und das Unternehmen räumt selbst ein, zur Bewertung der Systeme eigene Modelle einzusetzen. Dadurch kann eine Situation entstehen, in der das bewertende Modell dieselben Fehler macht wie das Modell, das bewertet wird. Zudem fehlt den KI-Laboren derzeit eine gemeinsame Methodik, mit der sich die Zahlen von Anthropic, OpenAI und Google DeepMind fair miteinander vergleichen ließen.
Es wäre daher verfrüht zu behaupten, Claude erledige bereits ein Viertel der Arbeit der Anthropic-Forschenden oder entwickle sich autonom selbst weiter.
Eine wesentlich präzisere – und tatsächlich interessantere – Schlussfolgerung lautet: Bei einem immer größeren Anteil der Entwicklung modernster KI wechseln Menschen von der Rolle der aktiv Ausführenden in die Rolle der Aufgabensteller und Aufsichtspersonen.
Wenn Claude nach der Kennzahl von Anthropic im Februar bei weniger als 1 % der Entwicklungsarbeit federführend war und im August bereits bei 26 %, dann gilt es, in künftigen Berichten vor allem diese Kurve zu beobachten. Eine KI, die beim Bau der nächsten KI hilft, ist keine theoretische Idee mehr. Vorerst braucht sie dabei einfach noch einen Menschen an ihrer Seite.