Codex entfernt blockierende Test-Infrastruktur
Asana hat das nicht mehr aktiv gepflegte Frontend-Testsystem Enzyme aus seiner Codebasis entfernt. Die veraltete Infrastruktur erschwerte Software-Upgrades und blockierte damit die Modernisierung des Frontend-Stacks.
Für das Refactoring setzte das Unternehmen OpenAI Codex und mehrere parallel arbeitende Coding-Agenten ein. Nach 1,5 Wochen reiner Entwicklungszeit, verteilt auf zwei Kalenderwochen, war Enzyme vollständig entfernt.
| Kennzahl | Frühere Planung | Umsetzung mit Codex |
|---|---|---|
| Dauer | Mindestens 5 Jahre | 2 Kalenderwochen |
| Aufwand | Mehrjähriger Personalplan | 1,5 Wochen Entwicklungszeit |
| Kosten | Rund 6.000.000 US-Dollar Personalkosten | Rund 12.000 US-Dollar für Modell und Infrastruktur |
| Parallelität | Nicht genannt | Bis zu 4 Coding-Agenten |
Der Kostenvergleich braucht eine klare Einschränkung. Die 12.000 US-Dollar umfassen nur Modell und Infrastruktur, nicht das Gehalt des beteiligten Entwicklers. Zudem ist nicht unabhängig belegt, wie belastbar die ursprüngliche Schätzung von fünf Jahren und 6 Millionen US-Dollar war.
Fünf Sätze steuerten vier Coding-Agenten
Die Aufgabe wurde mit einem Prompt aus fünf Sätzen gesteuert. Bis zu vier Agenten arbeiteten gleichzeitig, jeweils in einer separaten Kopie der Codebasis. Nach Angaben von Asana funktionierten einfache Anweisungen besser als ein komplexer Aufbau.
Ein Software-Ingenieur kontrollierte den Fortschritt zweimal täglich. Jede vorgeschlagene Codeänderung wurde manuell begutachtet und freigegeben. Der Fall ist damit kein Beispiel für vollständig autonome Softwareentwicklung, sondern für eine stark automatisierte Umsetzung mit konsequentem Human-in-the-Loop.
Gerade dieser Kontrollschritt ist entscheidend. Untersuchungen zu den Grenzen menschlicher Freigaben bei Coding-Agenten zeigen, dass ein Review allein noch keine vollständige Sicherheit schafft. Gleichzeitig kann das steigende Änderungsvolumen den Code-Review zum Engpass der KI-Entwicklung machen.
„Nicht jedes mehrjährige Projekt wird auf wenige Wochen schrumpfen. Aber Agenten können Entwicklern mehr Raum für ihr Handwerk geben und Arbeiten wirtschaftlich machen, die zuvor kaum realistisch erschienen.“
Amritansh Raghav, Chief Technology Officer von Asana, sinngemäß aus dem Englischen
Legacy-Modernisierung wird neu kalkulierbar
Für Unternehmen im DACH-Raum liegt die Bedeutung weniger im konkreten Testwerkzeug als in der Kostenstruktur. Viele IT-Abteilungen tragen historisch gewachsene Anwendungen mit sich, deren Modernisierung wegen hoher Personalbudgets über Jahre verschoben wird. Coding-Agenten können solche Vorhaben in kleinere und wirtschaftlich tragfähige Projekte verwandeln.
Das verändert auch die Entscheidung zwischen Eigenentwicklung und zusätzlicher Standardsoftware. Wenn bestehender Code mit überschaubaren Modellkosten modernisiert werden kann, verliert der Kauf eines weiteren teuren SaaS-Abos einen Teil seines wirtschaftlichen Vorsprungs. Voraussetzung bleiben eine beherrschbare Codebasis, automatisierte Tests und qualifizierte interne Reviews.
Die Abhängigkeit verschwindet dabei nicht, sondern verlagert sich. Statt ausschließlich an einen Software-Anbieter gebunden zu sein, entsteht eine neue Bindung an Modell-APIs, Preise und technische Schnittstellen. Das Problem zeigt sich auch bei eigenen Coding-Agenten mit externer Modellabhängigkeit.
Qualität und Folgekosten bleiben offen
Aus der kurzen Projektdauer lässt sich noch keine Aussage über die langfristige Fehlerfreiheit und Wartbarkeit des erzeugten Testcodes ableiten. Dazu wurden keine belastbaren Ergebnisse genannt. Auch die tatsächlichen Gesamtkosten einschließlich der Arbeitszeit des prüfenden Entwicklers bleiben offen.
Asana will den Ansatz dennoch auf weitere Migrationen, Neuentwicklungen und Performance-Optimierungen übertragen. Der entscheidende betriebliche Effekt liegt damit nicht nur in diesem einzelnen Refactoring. Projekte, die bislang wegen ihrer Dauer aus der Planung gefallen sind, können unter veränderten Kostenannahmen erneut bewertet werden.

