Wie ein KI-Audit wirklich abläuft: von der Einschätzung zur priorisierten Roadmap
Illustration: KI-generiert
Die technische Umsetzung von KI wird gerade jeden Monat einfacher und günstiger. Tools wie Claude, Cursor oder Copilot und unzählige No-Code-Plattformen machen es leichter denn je, einen ersten Agenten oder Workflow selbst zu bauen. Man könnte meinen, damit brauche niemand mehr Beratung.
Das Gegenteil ist der Fall. Je einfacher das Bauen wird, desto größer wird die Frage, was sich überhaupt zu bauen lohnt. Der Engpass verschiebt sich von der Technik zur Klarheit. Und Klarheit entsteht nicht durch noch ein Tool, sondern durch eine saubere Standortbestimmung. Genau das leistet ein KI-Audit.
Dieser Beitrag beschreibt keinen abstrakten Idealprozess, sondern den Ablauf, den wir tatsächlich fahren: 90 Minuten, sieben getaktete Blöcke, am Ende ein Dokument. Inklusive der Fragen, die dabei gestellt werden, und dessen, was am Schluss darin steht.
Warum die meisten KI-Projekte nicht an der Technik scheitern
Die meisten KI-Initiativen scheitern nicht, weil das Modell zu schwach war. Sie scheitern an fehlender Orientierung: Wo anfangen? Was hat wirklich Wirkung? Was ist machbar, und in welcher Reihenfolge rechnet es sich?
Der meistzitierte Beleg dafür ist der Report „The GenAI Divide: State of AI in Business 2025" von MIT Project NANDA aus dem Juli 2025. Sein Befund: Die große Mehrheit der untersuchten Vorhaben mit generativer KI liefert keinen messbaren Beitrag zum Ergebnis, trotz Investitionen im zweistelligen Milliardenbereich.
Diese Zahl solltest du mit Vorsicht lesen, und wir schreiben das bewusst dazu. Der Report ist nicht peer-reviewt, er stützt sich auf gut 300 öffentlich dokumentierte Initiativen, 52 Interviews und 153 befragte Führungskräfte, und er ist methodisch deutlich kritisiert worden. Für das Argument in diesem Beitrag ist die Prozentzahl ohnehin nicht entscheidend.
Interessanter ist die Begründung, die der Report selbst liefert: Piloten bleiben stecken, weil die eingesetzten Werkzeuge Rückmeldungen nicht behalten, sich nicht an den Kontext anpassen und mit der Zeit nicht besser werden. Übersetzt heißt das, das Vorhaben wurde an einer Stelle gestartet, an der es nie in den Arbeitsalltag hineinwachsen konnte. Das ist kein Technikproblem, sondern ein Auswahlproblem. Und genau davor setzt ein strukturierter Audit an.
Was ein KI-Audit ist, und was es nicht ist
Ein KI-Audit ist kein verlängertes Kennenlern-Gespräch und keine Tool-Demo. Es ist eine getaktete Arbeitssitzung mit festem Ablauf, an deren Ende ein Ergebnisdokument steht, das du noch im Termin zugesagt bekommst.
Das wichtigste Arbeitsprinzip dabei: Es wird nichts geschätzt. Alles, was am Ende im Dokument steht, stammt aus deinen eigenen Angaben im Gespräch. Mitgeschrieben wird live, sichtbar, während wir reden. Damit siehst du in der Sitzung selbst, wie aus dem, was du erzählst, eine Priorisierung wird, statt drei Wochen später einen Foliensatz zu bekommen, den du nicht mehr nachvollziehen kannst.
Der 90-Minuten-Ablauf im Überblick
| Block | Minute | Was am Ende dieses Blocks steht |
|---|---|---|
| Setup und Rahmen | 0–10 | Zielbild, Auslöser, Rahmen der Sitzung |
| Discovery | 10–35 | Liste konkreter Zeitfresser je Bereich |
| Stack und Daten | 30–40 | Systemlandschaft, Datenreife, Pflicht-Integrationen |
| Potenziale | 40–55 | Kandidatenliste möglicher KI-Lösungen |
| Priorisierung | 55–75 | Bewertete Matrix aus Wirkung und Aufwand |
| Roadmap und nächste Schritte | 75–88 | Reihenfolge und Compliance-Punkte |
| Abschluss | 88–90 | Zusammenfassung und Ergebnisdokument |
Die Übergänge sind fließend, Discovery und Stack laufen in der Praxis ineinander. Der Takt ist trotzdem kein Selbstzweck: Er verhindert, dass die Sitzung im ersten spannenden Thema hängen bleibt und die Priorisierung am Ende unter Zeitdruck gerät. Genau dort entsteht sonst der Fehler, an dem später das ganze Projekt hängt.
Setup und Rahmen: das Zielbild schärfen
Die ersten zehn Minuten klären, mit welchem einen Ergebnis du aus der Sitzung herausgehen willst und warum das Thema gerade jetzt auf dem Tisch liegt. Das ist keine Höflichkeitsrunde. Wer den Auslöser kennt, also verlorene Ausschreibungen, ein wachsendes Team ohne wachsende Prozesse oder Druck aus der Geschäftsführung, bewertet die späteren Potenziale völlig anders.
Discovery: wo die Zeit wirklich verloren geht
Der längste Block. Wir gehen deine Bereiche einzeln durch und suchen pro Bereich ein bis zwei konkrete Schmerzpunkte. Drei Fragen tragen den Großteil davon:
- „Nimm mich mal durch eine typische Woche. Wo verliert dein Team die meiste Zeit?"
- „Welche Aufgaben sind repetitiv, manuell oder Copy-Paste-lastig?"
- „Wo kosten Fehler oder Verzögerungen am meisten?"
Die Fragen sind bewusst schlicht. Der Wert steckt nicht in der Frage, sondern darin, nicht bei der ersten Antwort stehenzubleiben. „Wir machen viel manuell" ist kein Pain Point. „Zwei Leute übertragen jeden Montag Angebotsdaten aus dem Postfach ins ERP und brauchen dafür einen halben Tag" ist einer, weil er sich beziffern und automatisieren lässt.
Stack und Daten: was schon da ist
Bevor über Lösungen geredet wird, muss klar sein, woran sie andocken müssten:
- „Welche Tools nutzt ihr heute, also CRM, ERP, Tabellen?"
- „Wie sauber und wie gut verknüpft sind eure Daten?"
- „Muss etwas zwingend integriert werden?"
Dieser Block entscheidet später über die Aufwandsbewertung. Dieselbe Idee ist ein Quick Win, wenn die Daten in einem sauberen CRM mit offener Schnittstelle liegen, und eine Big Bet, wenn sie über vier Systeme und eine gewachsene Excel-Landschaft verteilt sind. Wer diesen Schritt überspringt, bewertet Aufwand ins Blaue.
Potenziale: für jeden Engpass eine Idee
Jetzt erst kommen Lösungen ins Spiel, ein bis zwei je Schmerzpunkt, jeweils mit einer einzigen Zeile Begründung, warum gerade das. Diese Zeile landet unverändert im Dokument und ist wichtiger, als sie aussieht: Sie zwingt dazu, den Nutzen in einem Satz zu benennen. Was sich nicht in einem Satz begründen lässt, überlebt die Priorisierung selten.
Bewertet wird hier noch nichts. Sammeln und Bewerten werden bewusst getrennt, weil sonst die unbequemen Ideen früh aussortiert werden, bevor jemand ihre Wirkung überhaupt eingeschätzt hat.
Priorisierung: Wirkung mal Aufwand
Jedes gesammelte Potenzial bekommt zwei Bewertungen, Wirkung und Aufwand, jeweils niedrig, mittel oder hoch. Daraus fällt die Einordnung automatisch in vier Felder:
| Feld | Wirkung | Aufwand | Was damit passiert |
|---|---|---|---|
| Quick Win | Hoch | Niedrig | Kommt zuerst, oft in den ersten 90 Tagen |
| Big Bet | Hoch | Hoch | Lohnt sich, braucht aber einen echten Plan |
| Nice-to-have | Niedrig | Niedrig | Nur, wenn Kapazität übrig ist |
| Skip | Niedrig | Hoch | Wird bewusst nicht gebaut |
Aus den bewerteten Potenzialen werden gemeinsam die Top drei bis fünf markiert. Das interessanteste Feld ist dabei nicht Quick Win, sondern Skip. Fast jedes Unternehmen bringt zwei bis drei Ideen mit, die intern längst gesetzt sind und trotzdem viel Aufwand bei wenig Wirkung bedeuten. Sie im Termin sichtbar auszusortieren, spart oft mehr Geld als der erste Quick Win einbringt.
Ein Audit, das nur sagt, was du bauen sollst, ist ein Verkaufsgespräch. Eines, das auch sagt, was du weglassen sollst, ist eine Beratung.
Roadmap und Compliance
Aus den markierten Potenzialen wird eine Reihenfolge, Quick Wins zuerst, Big Bets in einer zweiten Phase. Der Grund ist weniger technisch als organisatorisch: Ein sichtbarer früher Erfolg finanziert intern die Geduld für das große Vorhaben.
Bevor die Reihenfolge steht, gehen wir vier Compliance-Punkte durch:
- EU AI Act: Liegt überhaupt eine Hochrisiko-Anwendung nach Anhang III vor? Bei den meisten Automatisierungen im operativen Betrieb ist das nicht der Fall, dann greifen vor allem die Transparenzpflichten aus Artikel 50. Anders wird es, sobald KI in Auswahl- oder Personalentscheidungen hineinreicht.
- DSGVO: Sind personenbezogene Daten betroffen, und auf welcher Rechtsgrundlage werden sie verarbeitet?
- UAE PDPL: Bei Vorhaben mit Bezug zur Region die Fragen nach Datenresidenz und Einwilligung.
- Mensch in der Schleife: Bei welchen Entscheidungen muss zwingend jemand bestätigen, bevor etwas passiert?
Das ersetzt keine Rechtsberatung. Es verhindert aber, dass ein Vorhaben erst in der Umsetzung an einer Frage scheitert, die sich zu Beginn in zehn Minuten hätte klären lassen. In Unternehmen mit Betriebsrat kommt regelmäßig ein fünfter Punkt dazu, denn Systeme, die Leistung oder Verhalten erfassen können, sind mitbestimmungspflichtig. Das ist in der Praxis oft die größere Hürde als der AI Act.
Abschluss: was du in der Hand hältst
Die letzten Minuten fassen zusammen und sichern den Übergang. Das Ergebnisdokument enthält:
- Ausgangslage und Zielbild, in deinen eigenen Worten festgehalten
- Die identifizierten Engpässe je Unternehmensbereich
- Die Potenziale, jeweils mit der einen Zeile Begründung
- Die Matrix mit der Einordnung jedes Potenzials in Quick Win, Big Bet, Nice-to-have oder Skip
- Die empfohlene Reihenfolge, Quick Wins zuerst
- Die relevanten Compliance-Punkte
- Die Empfehlung für den nächsten Schritt
Keine Foliensammlung voller Allgemeinplätze, sondern eine priorisierte Landkarte deiner größten Hebel. Und, das ist der eigentliche Prüfstein: Jede Aussage darin lässt sich auf etwas zurückführen, das im Termin gesagt wurde.
Wenn 90 Minuten nicht reichen: der Strategie-Sprint
Das Audit verdichtet die Standortbestimmung auf das Wesentliche. Es arbeitet mit dem, was in anderthalb Stunden aus einem Gespräch herauszuholen ist, und das ist bewusst eine Momentaufnahme aus einer Perspektive. Reicht dir das, hast du Klarheit über den größten Hebel und kannst loslegen.
Brauchst du einen Plan, den dein Management freigeben kann, folgt der Strategie-Sprint über zwei Wochen. Er läuft in drei Phasen:
| Phase | Was passiert | Ergebnis |
|---|---|---|
| Discovery und Mapping | Gespräche mit Führungskräften und Schlüsselpersonen, Aufnahme der wichtigsten Prozesse im Ist-Zustand | Belegte Inventur der Engpässe statt einer Momentaufnahme |
| Opportunity Design | Dokumentierte Sammlung der Anwendungsfälle, technische Machbarkeitsprüfung je Fall | Bewertete Use-Case-Liste und Zielarchitektur |
| Validierung und Roadmap | Gemeinsame Priorisierung, Wirkungs- und Aufwandsrechnung, Abstimmung mit dem Management | Roadmap über 90 Tage und 12 Monate plus Business Case |
Der Unterschied liegt nicht in der Länge, sondern in der Belastbarkeit. Der Audit zeigt, wo die Hebel liegen. Der Sprint zeigt, was sie bringen, was sie kosten und in welcher Reihenfolge sie sich rechnen, plus eine Automations-Architektur, die beschreibt, wie es technisch zusammenpasst. Das KI-Audit ist dabei voll auf den Sprint anrechenbar.
Woran du ein gutes KI-Audit erkennst
Der Unterschied liegt nicht in der Zahl der Folien, sondern in vier Dingen.
- Es arbeitet mit deinen Zahlen, nicht mit Branchendurchschnitten. Jede Aussage im Ergebnis muss sich auf etwas zurückführen lassen, das im Termin gesagt wurde.
- Es trennt Sammeln und Bewerten. Wer Ideen sofort bewertet, verliert die unbequemen, bevor jemand ihre Wirkung eingeschätzt hat.
- Es benennt Aufwand ehrlich. Wer nie selbst gebaut hat, unterschätzt Integrationen zuverlässig. Aufwandsschätzungen ohne Umsetzungserfahrung sind Wunschdenken.
- Es liefert ein Dokument, das du selbst erklären kannst. Wenn du das Ergebnis deiner Geschäftsführung nicht in fünf Minuten weitererzählen kannst, war es das falsche Ergebnis.
Fazit: Klarheit ist der neue Engpass
Die Umsetzung von KI wird weiter einfacher. Der Engpass verlagert sich damit auf die Frage, was sich wirklich lohnt, in welcher Reihenfolge und mit welchem erwartbaren Effekt. Genau diese Fragen beantwortet ein guter KI-Audit.
Wenn du merkst, dass KI-Initiativen bei dir stecken bleiben oder gar nicht erst richtig starten, ist der sinnvollste nächste Schritt keine weitere Tool-Recherche, sondern eine klare Standortbestimmung. Anderthalb Stunden reichen dafür weiter, als die meisten erwarten.
Key Takeaways
- 1Nicht die Technik ist der Engpass, sondern die Klarheit darüber, was sich lohnt und in welcher Reihenfolge.
- 2Das KI-Audit läuft in 90 Minuten und sieben getakteten Blöcken: Setup, Discovery, Stack und Daten, Potenziale, Priorisierung, Roadmap, Abschluss.
- 3Priorisiert wird nach Wirkung mal Aufwand in vier Feldern. Das wertvollste davon ist Skip, also das, was bewusst nicht gebaut wird.
- 4Der Strategie-Sprint über zwei Wochen ist die Vertiefung in drei Phasen mit Architektur und Business Case. Das Audit ist voll darauf anrechenbar.
Quellen: Die Aussage zu wirkungslosen KI-Piloten stammt aus dem Report „The GenAI Divide: State of AI in Business 2025" von MIT Project NANDA (Juli 2025). Der Report ist nicht peer-reviewt und stützt sich auf gut 300 öffentlich dokumentierte Initiativen, 52 strukturierte Interviews und 153 befragte Führungskräfte; seine Methodik ist öffentlich kritisiert worden. Wir zitieren ihn wegen seiner Begründung für das Scheitern, nicht wegen der Prozentzahl. Die Hinweise zu EU AI Act, DSGVO, UAE PDPL und Mitbestimmung sind allgemeine Einordnung und ersetzen keine Rechtsberatung.