Künstliche Intelligenz treibt die Menge an erzeugtem Code in der Softwareentwicklung massiv nach oben, doch die tatsächliche Fertigstellung von Softwareprojekten stagniert. Eine umfassende Auswertung von Millionen Arbeitsereignissen zeigt, dass der Gewinn an Quantität durch längere Prüfzeiten und einen wachsenden Aufwand bei der Qualitätssicherung neutralisiert wird.
Die Softwarebranche erlebt durch den Einsatz automatisierter Coding-Agenten und KI-Assistenten einen tiefgreifenden Wandel. Entwickler können Programmieraufgaben heute in Sekundenschnelle anstoßen, während autonome Agenten über Repositorys, Werkzeuge und Cloud-Umgebungen hinweg agieren. Dennoch zeigt sich in der Praxis ein überraschendes Missverhältnis zwischen dem schieren Ausstoß an Programmcode und dem echten Projektfortschritt.
Während des größten Teils der Geschichte der Softwareentwicklung waren Menschen die Kontrollinstanz, bei der ein Entwickler eine Änderung vornimmt, eine andere Person sie prüft, jemand sie genehmigt und schließlich die Bereitstellung erfolgt.
Datenanalyse von Harvard zur Code-Menge
Eine umfangreiche Untersuchung der Harvard University, durchgeführt von den Forschern Fiona Chen und James Stratton, beleuchtet diese Entwicklung anhand aggregierter Daten der Plattform Jellyfish. Die Auswertung stützt sich auf rund 300 Millionen Arbeitsereignisse von etwa 700.000 Beschäftigten aus über 700 Softwareunternehmen im Zeitraum von 2021 bis Anfang 2026.

Nach der Einführung von KI-Coding-Agenten legten die analysierten Kennzahlen auf den ersten Blick kräftig zu. Die Gesamtmenge des geschriebenen Codes wuchs um 30 Prozent, die Anzahl der Commits stieg im Durchschnitt um 20 Prozent, und die eingereichten Pull Requests nahmen um 23 Prozent zu. Die Erledigungsrate für größere Features in Projektmanagement-Tools wie Jira blieb jedoch unverändert. Der Zuwachs an Programmzeilen schlägt sich somit nicht in einer schnelleren Auslieferung funktionaler Software nieder.
Bain- und SmartBear-Untersuchungen zum Prüfaufwand
Zusätzliche Branchenerhebungen untermauern diese Diskrepanz. Ein Technologiebericht von Bain & Co., der rund 300 leitende Technologie-Führungskräfte einbezog, verzeichnet einen Aufgaben-Zuwachs von etwa 21 Prozent durch KI-gestützte Coding-Tools. Gleichzeitig kletterte die für Code-Reviews benötigte Zeit um 91 Prozent nach oben, während Entwickler 47 Prozent mehr parallele Arbeitsstränge koordinieren müssen.
Während 73 Prozent der Führungskräfte KI-Code vertrauen, teilen nur 52 Prozent der Praktiker diese Haltung, und lediglich 46 Prozent validieren Spezifikationen vor der Generierung.

Herausforderungen in der Qualitätssicherung und bei AgentOps
Der Review-Prozess hat sich als massiver Engpass erwiesen. Die Zeitspanne zwischen dem Absenden eines Pull Requests und dessen Übernahme verlängerte sich um rund 49 Prozent. Zudem hat sich die Qualität des eingereichten Codes nicht verbessert: Die Anzahl der mit einer Änderungsanfrage zurückgewiesenen Pull Requests hat sich fast verdoppelt, und die Kommentare pro Request stiegen um 35 Prozent.
Um diese Flut zu bewältigen, mussten 14 Prozent mehr Beschäftigte in den Review-Prozess eingebunden werden. Die Kontrolle muss näher an der Aktion liegen, die die KI ausführen möchte, und über den gesamten Lebenszyklus hinweg regulatorische Vorgaben wie den EU AI Act berücksichtigen.
Veränderte Rollenbilder und Zukunft der Softwareentwicklung
Der Wandel betrifft auch etablierte Berufsfelder und die Ausbildung des Nachwuchses. Technologieverantwortliche sehen durch den Wegfall grundlegender Programmierarbeiten auch die praktische Erfahrung gefährdet.
Das Software-Engineering wandelt sich von einer arbeitsintensiven, codezentrierten Disziplin zur Entwicklung und Steuerung intelligenter, anpassungsfähiger Systeme. Rollen wie Requirements Engineers werden zu Business Value Designern, die Geschäftsabsichten und Erfolgskriterien für die Zusammenarbeit von Mensch und KI übersetzen, während Testmanager als AI Quality Governors mehr Verantwortung für Leitplanken, Kontrollen und Risiken übernehmen. Der Wert verschiebt sich von reiner Code-Quantität hin zu Systemdesign, Architekturkompetenz und klaren Leitplanken für autonome Agenten.
Auch interessant