Software mit KI entwickeln, ohne die Kontrolle zu verlieren

Mit KI steht die erste Version einer Anwendung deutlich früher. Das ist vor allem deshalb wertvoll, weil Ihre Leute dann an einem echten Ablauf sitzen statt an einer Beschreibung und viel genauer sagen können, was noch fehlt. Aus einer abstrakten Diskussion wird ein Klickpfad, den man ausprobieren kann.
Schnell zu bauen ist dabei nur das Mittel. Worum es eigentlich geht, ist, dass Ihr Team mehr schafft, ohne dass Sie mehr Leute einstellen müssen, und dass weniger Arbeit über einen einzigen Schreibtisch läuft. Ob dafür eine Business-App passt, ein KI-Agent oder beides zusammen, entscheidet der Ablauf und nicht das Werkzeug.
Geschwindigkeit allein ergibt allerdings noch kein Produkt. Ohne Architektur, Tests und eine klare Verantwortung für die Daten entsteht Unordnung eben auch schneller. Zwischen einer beeindruckenden Demo und einer Software, auf die sich ein Betrieb jeden Tag verlässt, liegt der ganze Rahmen darum herum, und der ist das Thema dieses Artikels.
Dass sich Entwicklungstempo nicht als feste Eigenschaft von KI beziffern lässt, zeigen zwei sehr unterschiedliche Untersuchungen. In einer randomisierten Studie von METR brauchten 16 erfahrene Open-Source-Entwickler mit Werkzeugen vom Jahresanfang 2025 für 246 Aufgaben 19 % länger. Der vendor-nahe DORA-Bericht von Google aus 2025 findet dagegen in einer Befragung positive Zusammenhänge mit Durchsatz und Produktleistung, aber weiterhin einen negativen Zusammenhang mit Lieferstabilität. Die Stichproben, Methoden und Werkzeuggenerationen sind nicht vergleichbar genug für einen Sieger. Zusammen stützen sie den wichtigeren Punkt: Aufgabe, Repository-Kenntnis, Tests, Review und Auslieferungssystem entscheiden mit.
Was KI gut beschleunigt
KI ist am stärksten dort, wo es viele bekannte Muster gibt und schnelle Varianten helfen. Sie liefert einen ersten Entwurf, den ein Entwickler prüft, schärft und verantwortet.
- Prototypen, Formulare, Listen und erste Abläufe, die man sofort ausprobieren kann.
- Varianten einer Oberfläche oder Interaktion, um die bessere Lösung zu sehen statt zu erraten.
- Testdaten, Validierungen und einfache Integrationen zwischen bestehenden Systemen.
- Dokumentation, Refactorings und wiederkehrende technische Routine.
Dasselbe Entwurf-und-Prüfung-Muster gilt auch im Produkt selbst. XPO Inventory hält es bewusst eng. Dort hilft eine KI-Foto-Vorausfüllung bei der Anlage eines Artikels. Sie schlägt aus einem Foto Name, Beschreibung, Farbe, Kategorie und Einheit vor. Maße und Menge bleiben manuell, weil falsche Werte den Inventarprozess unmittelbar treffen. Die veröffentlichte XPO-Inventory-Fallstudie dokumentiert genau diese Grenze.
Wo aus Tempo Unordnung wird
Dieselbe Geschwindigkeit führt ein unstrukturiertes Projekt entsprechend schneller ins Chaos. KI-Werkzeuge neigen dazu, lokal zu lösen. Sie schreiben eine neue Hilfsfunktion oder eine weitere Komponente, obwohl es dafür längst eine etablierte Stelle im Projekt gibt, weil sie diese Stelle im Zweifel nicht gesehen haben. Im ersten Moment läuft das Ergebnis, und genau das macht es tückisch. Mit jeder weiteren Aufgabe wird der Code schwerer wartbar, doppelte Komponenten sammeln sich an, die Datenmodelle driften auseinander und irgendwann traut sich niemand mehr, etwas zu löschen. Das liegt aber selten an der KI. Es liegt daran, dass niemand die Regeln festgelegt hat, innerhalb derer sie arbeiten soll.
Der Rahmen, der aus Tempo ein belastbares System macht
Kontrolle entsteht durch bewusste Entscheidungen, die Menschen treffen und die KI danach zuverlässig ausfüllt. Diese Entscheidungen sind der eigentliche Wert, und sie lassen sich benennen:
- Architektur und Datenmodell. Wo liegen die Datenzugriffe, wo die Fachlogik, und bildet die gewählte Struktur den Prozess überhaupt korrekt ab?
- TypeScript und Typprüfung. Klare Typen fangen falsche Annahmen ab, bevor sie in Produktion sichtbar werden.
- Tests, und zwar auf allen drei Ebenen, von der einzelnen Berechnung bis zum durchgespielten Ablauf.
- CI/CD. Jede Änderung durchläuft dieselben Prüfungen und lässt sich nachvollziehbar zurücknehmen, wenn sie doch nicht trägt.
- Berechtigungen. Wer darf was sehen und ändern, das ist die Frage, bei der KI-Output am sorgfältigsten geprüft gehört.
Diese Elemente sind die Voraussetzung dafür, dass das Tempo dauerhaft trägt. Ein bewusst eng gehaltener Tech-Stack hilft zusätzlich, denn wenn Framework, Datenzugriff und Teststrategie einmal feststehen, arbeitet die KI innerhalb bekannter Muster, statt jedes Mal etwas Neues zu erfinden. Wie man diese Grenzen konkret setzt, steht in Wie Sie beim KI-Coding die Kontrolle behalten.
Das XPO-Beispiel übersetzt den Rahmen in eine Lieferentscheidung: KI entwirft nur dort, wo ein Mensch den Vorschlag leicht prüfen und korrigieren kann; bestandskritische Werte bleiben im kontrollierten Eingabefluss. Die dokumentierte Umsetzung liefert die Regel, Geschwindigkeit an einer Stelle mit begrenztem Fehler zu nutzen und die verlässliche Fachlogik darum herum vollständig ohne KI zu halten.
Menschen entscheiden, KI beschleunigt
Der produktive Umgang mit KI ist eine klare Rollenverteilung. Menschen definieren Ziel, Architektur, Datenmodell, Sicherheitsanforderungen und Akzeptanzkriterien. KI hilft beim Entwurf, beim Schreiben, beim Refactoring und beim Erklären. Am Ende muss ein Mensch den Code verstehen, prüfen und verantworten.
Entscheidend ist das richtige Maß an Prüfung. KI-Agenten übernehmen ganze Aufgaben selbstständig, in Schritten, innerhalb klarer Werkzeuge, Rechte und Tests. Für Recherche, Analyse und Entwicklung gilt Beschleunigung mit menschlichem Urteil, nicht KI, die unbeaufsichtigt entwickelt. Die Prüfung konzentriert sich dort, wo Kontext fehlt: bei mehrdeutigen Fachregeln, bei Berechtigungen und überall dort, wo plausibel aussehender Output trotzdem das falsche Problem lösen kann.
Wann ein Agent reicht und wann eigene Software dazukommt
Ein Agent übernimmt ganze Aufgaben, in Schritten, innerhalb seiner Werkzeuge, Rechte und Tests. Er liest, recherchiert, gleicht ab und legt ein Ergebnis vor. Verbindliches gibt ein Mensch frei; kleine, umkehrbare Schritte laufen automatisch mit Stichprobe. Für viele Aufgaben genügt dafür ein vorhandenes Werkzeug mit einer guten Arbeitsanweisung. Eigene Software wird interessant, wenn verbindliche Daten, mehrere Zuständigkeiten, Verbindungen zu anderen Programmen oder externe Nutzer eine gemeinsame Grundlage brauchen. Beide Wege stehen nebeneinander, und welcher passt, entscheidet der Ablauf.
Und der Code gehört Ihnen
Was KI beschleunigt hat, sollte trotzdem in Ihrem Besitz bleiben: getestet und so dokumentiert, dass andere Entwickler den Code weiterentwickeln können. Dann können Sie die nächste Änderung auch von jemand anderem umsetzen lassen.
Ersetzt KI die Softwareentwicklung?
Nein. KI beschleunigt Entwurf, Code und Routine, aber Architektur, Datenmodell, Sicherheit und die Frage, ob das richtige Problem gelöst wird, bleiben menschliche Entscheidungen. KI liefert schneller Vorschläge innerhalb eines Systems, das Menschen bewusst gestalten und verantworten. Dabei hilft sie beim Schreiben, Refactoring und Erklären.
Kann man mit KI gebauten Code in Produktion einsetzen?
Ja, wenn die Prüfung zum Risiko passt. Typprüfung, Tests und ein nachvollziehbares Deployment gelten für jede Änderung; wie tief ein Mensch darüber hinaus liest, hängt davon ab, was der Code berührt. Wo Geld, Kunden, Berechtigungen oder Datenzugriffe betroffen sind, lesen wir vollständig mit. Bei unkritischer Routine reichen die automatischen Prüfungen und ein Blick auf das Ergebnis.
Sollten wir selbst mit KI bauen oder bauen lassen?
Für kleine, interne und unkritische Tools lohnt sich der eigene Versuch oft. Sobald Software geschäftskritisch wird, mehrere Nutzer und sensible Daten betrifft oder über Jahre laufen muss, entscheidet die Engineering-Disziplin über die Gesamtkosten. Den Entscheidungsrahmen liefert der Vergleich von Individual- und Standardsoftware.
Wie viel menschliches Review braucht KI-Code?
So viel, wie der fehlende Kontext verlangt. Syntax, Typen und Datenform lassen sich automatisch prüfen; Fachregeln, Berechtigungen und die Produktfrage brauchen menschliches Urteil. Kritische Abläufe werden sorgfältig geprüft, unkritische Routine leichter. Die Prüfung konzentriert sich dort, wo Kontext fehlt oder plausibel aussehender Output das falsche Problem löst.
Wenn der Code Ihnen gehört und andere Entwickler ihn übernehmen können, bleiben Sie auch nach dem ersten Projekt handlungsfähig. Wie Sie beim KI-Coding die Kontrolle behalten, zeigt der vertiefende Leitfaden.
Wenn Sie einen Prozess mit KI-Tempo bauen und dabei die Kontrolle behalten möchten, sprechen Sie direkt mit dem Entwickler.