Vorlage
KI-Use-Cases priorisieren: das EVORI-Bewertungsraster
Ein praxiserprobtes Raster mit vier Dimensionen und klaren Ankerwerten, um KI-Ideen im Unternehmen vergleichbar zu bewerten – inklusive Vorlage.
Dieses Raster beantwortet eine Frage: Welchen Prozess zuerst? Es bewertet jeden Kandidaten in vier Dimensionen mit je 1–5 Punkten. Entscheidend ist nicht die Präzision der Zahl, sondern dass alle Kandidaten mit denselben Ankern bewertet werden – am besten von zwei Personen unabhängig.
Die vier Dimensionen
Nutzen (1–5)
Wie viel wiederkehrender Aufwand oder Qualitätsverlust steckt heute im Prozess?
- 1 – Gelegentlich, wenige Minuten, eine Person.
- 3 – Wöchentlich spürbar, mehrere Beteiligte, gelegentliche Fehler mit Folgeaufwand.
- 5 – Täglich, teamübergreifend, Engpass mit sichtbaren Folgen für Kunden oder Abschluss.
Machbarkeit (1–5)
Wie gut kommt ein Workflow an Daten und Systeme heran?
- 1 – Papier, Insellösungen, keine Schnittstellen.
- 3 – Daten digital vorhanden, Zugriff klärbar, Systeme teilweise offen.
- 5 – Strukturierte Daten, erreichbare Schnittstellen, wiederkehrendes Muster.
Datensensibilität (1–5, invertiert)
Je höher der Wert, desto unkritischer die Daten.
- 1 – Besondere Kategorien (Gesundheit, Beschäftigtendaten im Konflikt), externe Weitergabe heikel. DSGVO-Prüfung zwingend vor jedem Test.
- 3 – Personenbezug vorhanden, aber übliche Geschäftsdaten; Auftragsverarbeitung klärbar.
- 5 – Interne Sach- und Produktdaten ohne Personenbezug.
Fehlertoleranz (1–5)
Was passiert, wenn ein Ergebnis falsch ist – und fällt es auf?
- 1 – Fehler wirken nach außen oder binden rechtlich, bevor jemand sie sieht.
- 3 – Fehler sind intern korrigierbar und fallen bei normaler Prüfung auf.
- 5 – Ergebnisse sind Vorschläge, die ohnehin ein Mensch übernimmt.
Auswertung
Addieren Sie die Punkte (4–20) und sortieren Sie – aber mit zwei Vetoregeln:
- Kein Kandidat startet mit Datensensibilität = 1, bevor die Datenschutzfrage geklärt ist, egal wie hoch die Summe ist.
- Kein Kandidat startet mit Fehlertoleranz = 1 ohne definierten Prüfpunkt – siehe Human-in-the-Loop praktisch definieren.
Die Summe hilft beim Vergleichen, ist aber keine Startfreigabe. Eine hohe Machbarkeit gleicht fehlenden wirtschaftlichen Nutzen nicht aus. Beispiel: Nutzen 1 und dreimal 5 ergeben 16 Punkte – wenige eingesparte Minuten begründen dadurch noch keine Sonderentwicklung.
Zusätzliche Voraussetzung vor Umsetzung: Erwartete Entlastung und Qualitätswirkung müssen den einmaligen und laufenden Kosten sowie dem internen Aufwand gegenübergestellt werden. Auch die menschliche Prüfung zählt zum Aufwand. Solange diese Rechnung nicht trägt oder wesentliche Annahmen offen sind, lautet das Ergebnis: nicht starten oder weiter klären.
Kandidaten mit hohem Nutzen und ungeklärtem Datenzugang können für eine spätere Prüfung vorgemerkt werden. Sie werden nicht allein aufgrund einer Punktzahl beauftragt.
Die Vorlage
Die Bewertung passt in eine einfache Tabelle:
| Kandidat | Nutzen | Machbarkeit | Datensensibilität | Fehlertoleranz | Summe | Veto? |
|---|---|---|---|---|---|---|
| Rechnungsprüfung | 4 | 4 | 3 | 3 | 14 | – |
| Angebotsentwürfe | 5 | 3 | 3 | 2 | 13 | Prüfpunkt nötig |
(Beispielwerte zur Illustration des Vorgehens, keine Projektergebnisse.)
Sie können die Vorlage als Textdatei herunterladen und im Team ausfüllen: Bewertungsraster herunterladen. Den heutigen Aufwand eines Kandidaten überschlagen Sie mit dem Zeitaufwand-Rechner.
Grenzen des Rasters
Das Raster ersetzt keine Wirtschaftlichkeitsrechnung und keine Rechtsprüfung. Es sorgt für eine belastbare Reihenfolge und verhindert die zwei teuersten Fehler: mit dem sensibelsten Prozess zu beginnen oder mit dem am schlechtesten erreichbaren.
Wenn Sie die Bewertung nicht allein durchführen möchten, ist genau das der Inhalt des KI-Hebel-Checks.
Quellen
Weiterlesen
Diesen Ansatz auf Ihren Prozess anwenden?
Ob erster Workflow oder bestehender Pilot: Wir klären die offenen Punkte und den passenden nächsten Schritt. Eine zusätzliche Analyse wird nur bei Bedarf separat beauftragt.