IT, Computer & Internet

Checking AI in Excel: How to keep spreadsheet analyses auditable

KI in Excel prüfen: So sichern österreichische Teams Datenumfang, Formeln und Aussagen mit Kontrollsummen, Stichproben und reproduzierbaren Rechenwegen.

An adult Austrian data analyst checks spreadsheet values on a tablet facing away at a warehouse workstation using physical inventory tags

Künstliche Intelligenz kann eine Tabelle in Sekunden zusammenfassen, Formeln vorschlagen und auffällige Werte beschreiben. Das spart Zeit – solange das Team nicht eine überzeugende Erklärung mit einer korrekten Analyse verwechselt. Fehlende Zeilen, falsch erkannte Datentypen oder ein unpassender Bezugszeitraum reichen aus, um aus einer plausiblen Aussage eine falsche Geschäftsentscheidung zu machen.

Anyone who KI in Excel und Tabellen nutzt, braucht deshalb einen Prüfweg, der auch ohne das Sprachmodell nachvollziehbar bleibt. Dieser Leitfaden zeigt österreichischen Teams, wie sie Daten vorbereiten, Berechnungen von Interpretation trennen und Ergebnisse mit Kontrollsummen, Stichproben und Versionen absichern.

KI darf erklären – die Rechenbasis muss reproduzierbar bleiben

Generative KI ist stark beim Strukturieren, Formulieren und Erkennen möglicher Muster. Sie kann Fragen an einen Datensatz vorschlagen oder eine komplizierte Formel in Alltagssprache erklären. Für exakte Summen, wiederholbare Berechnungen und Abschlusszahlen bleiben deterministische Tabellenfunktionen, Abfragen oder geprüfte Skripte der bessere Kern.

Microsoft weist in der Dokumentation seiner KI-Funktion für Excel darauf hin, für numerische Berechnungen mit Anspruch auf Genauigkeit und Reproduzierbarkeit native Funktionen wie SUMME oder MITTELWERT zu verwenden. Das ist eine nützliche Grundregel unabhängig vom Produkt: Die KI kann den Rechenweg vorbereiten oder kommentieren, aber die belastbare Zahl entsteht in einem prüfbaren Verfahren.

Die WKO empfiehlt in ihrer Guideline zur Sicherheit und Qualität von Daten, KI-Informationen mit gesichertem Fachwissen und aktuellen vertrauenswürdigen Quellen abzugleichen. Bei Tabellen ist die wichtigste Quelle häufig der korrekt abgegrenzte Originaldatensatz.

Vor der Analyse: Zweck und Entscheidung benennen

„Finde interessante Erkenntnisse“ liefert leicht beliebige Auffälligkeiten. Eine bessere Aufgabe benennt Entscheidung, Kennzahl, Zeitraum und Vergleich. Zum Beispiel: „Prüfe, welche Produktgruppen im zweiten Quartal mehr Rücksendungen hatten als im Vorjahresquartal; Stückzahl und Rücksendequote getrennt darstellen.“

Vor dem KI-Einsatz hält das Team vier Punkte fest:

  • Welche Entscheidung soll die Analyse unterstützen?
  • Welche Kennzahl beantwortet die Frage tatsächlich?
  • Welcher Zeitraum und welche Grundgesamtheit gelten?
  • Welche Fehlerfolge wäre geschäftlich relevant?

Diese Definition verhindert, dass das Werkzeug nachträglich eine andere Frage beantwortet als jene, die der Betrieb stellen wollte.

Daten erst lesbar machen, dann interpretieren

Ein Tabellenblatt kann für Menschen übersichtlich wirken und technisch dennoch unklar sein. Verbundene Zellen, mehrere Überschriften, Zwischensummen im Datenbereich, gemischte Datumsformate oder Zahlen als Text verändern die Analyse. Vor dem Upload oder der Freigabe an ein KI-System wird eine saubere Arbeitstabelle erstellt.

Sie sollte folgende Merkmale haben:

  • eine Zeile pro Beobachtung,
  • eine Spalte pro Merkmal,
  • eindeutige, kurze Spaltennamen,
  • einheitliche Datums-, Zahlen- und Währungsformate,
  • klar definierte leere Werte,
  • keine versteckten Zwischensummen im Rohdatenbereich,
  • eine stabile ID für jede Zeile, sofern erforderlich.

Das Original bleibt unverändert und schreibgeschützt. Bereinigungsschritte werden in einer separaten Datei, Abfrage oder dokumentierten Folge von Transformationen ausgeführt. So lässt sich ein Fehler zurückverfolgen.

Den Datenumfang mit einem Kontrollblatt sichern

Bevor die KI eine erste Aussage liefert, erstellt das Team ein Kontrollblatt mit wenigen harten Werten:

  • Anzahl der Zeilen und eindeutigen IDs,
  • Minimum und Maximum des Datums,
  • Summe wichtiger Mengen- und Geldspalten,
  • Anzahl leerer Werte je Pflichtfeld,
  • Anzahl doppelter IDs,
  • Verteilung der wichtigsten Kategorien.

Nach Import, Filterung und Analyse werden dieselben Werte erneut berechnet. Fehlen plötzlich 200 Zeilen oder ändert sich die Gesamtsumme ohne fachlichen Grund, wird nicht weiter interpretiert. Diese Abstimmung ist oft wirksamer als eine lange Plausibilitätserklärung.

Datenschutz und Geheimnisse vor dem Upload prüfen

Tabellen enthalten häufig Namen, Personalnummern, E-Mail-Adressen, Kundencodes, Gehälter oder Gesundheitsinformationen. Für viele Analysefragen sind diese Merkmale nicht nötig. Entfernen oder aggregieren Sie sie, bevor Daten an ein freigegebenes System gehen.

Der jobspot.at-Leitfaden zu Geschäftsgeheimnissen in KI-Tools zeigt einen Datenklassen- und Minimierungscheck. Für Tabellen kommt hinzu: ausgeblendete Blätter, Kommentare, definierte Namen, Pivot-Caches und Dateimetadaten prüfen. Das Löschen einer sichtbaren Spalte entfernt nicht zwingend jede Kopie der Information aus einer Arbeitsmappe.

Wenn die Analyse echte personenbezogene Daten benötigt, ist der konkrete Prozess mit Datenschutz und den zuständigen Stellen zu bewerten. Eine bloße Ersetzung von Namen durch IDs macht Daten nicht automatisch anonym.

Formelvorschläge Zelle für Zelle testen

Eine KI-generierte Formel wird wie fremder Code behandelt. Prüfen Sie:

  1. Sind Zell- und Bereichsbezüge vollständig?
  2. Verändern sich relative und absolute Bezüge beim Kopieren korrekt?
  3. Werden leere Werte, Fehler und Nullen fachlich richtig behandelt?
  4. Funktioniert die Formel an erster, mittlerer und letzter Datenzeile?
  5. Bleibt das Ergebnis bei eingefügten Zeilen oder neuen Kategorien korrekt?
  6. Ist die Funktion in der verwendeten Tabellen-Version verfügbar?

Microsoft beschreibt in seiner Hilfe zur Erkennung von Formelfehlern unter anderem das Risiko unvollständiger Bereiche. Eine Formel kann syntaktisch korrekt sein und trotzdem angrenzende Daten auslassen. Deshalb genügt das Fehlen einer Fehlermeldung nicht.

Fünf Prüfungen für jede KI-Erkenntnis

1. Rückrechnung

Kann die Aussage mit einer einfachen Pivot-Tabelle, Formel oder Abfrage reproduziert werden? „Region West wächst am stärksten“ braucht konkrete Ausgangswerte und eine klar definierte Wachstumsrate.

2. Stichprobe

Wählen Sie einige Originalzeilen aus, darunter Grenzfälle. Stimmen Kategorie, Datum und Wert in der Analyse? Eine Zufallsstichprobe plus bewusst schwierige Fälle ist besser als nur drei bequeme Beispiele.

3. Gegenhypothese

Welche alternative Erklärung gibt es? Ein Umsatzanstieg kann durch Preis, Menge, geänderte Zuordnung oder fehlende Rücksendungen entstehen. Bitten Sie die KI nicht nur um Bestätigung, sondern lassen Sie mögliche Störfaktoren auflisten und prüfen Sie diese separat.

4. Sensitivität

Bleibt das Ergebnis bestehen, wenn ein Ausreißer entfernt, der Zeitraum leicht verschoben oder eine andere sinnvolle Definition verwendet wird? Ein Befund, der an einer einzelnen Zeile hängt, sollte nicht als stabiler Trend präsentiert werden.

5. Fachreview

Eine Person mit Prozesswissen prüft, ob die Zahlen zur Realität passen. Sie weiß etwa, dass eine Filiale umgebaut wurde oder ein Artikelcode gewechselt hat. Der Datensatz allein enthält diesen Kontext möglicherweise nicht.

Interpretation und Berechnung sichtbar trennen

Ein guter Ergebnisbericht hat drei Ebenen:

  1. Berechnet: reproduzierbare Werte, Formeln, Filter und Zeitraum.
  2. Beobachtet: beschreibende Muster wie Anstieg, Unterschied oder Ausreißer.
  3. Interpretiert: mögliche Erklärung oder Handlungsempfehlung.

Die KI darf bei Ebene zwei und drei unterstützen. Leserinnen und Leser müssen aber erkennen, was gemessen und was vermutet wurde. Ein Satz wie „Die Lieferzeit verursachte die Kündigungen“ ist ohne geeignete Analyse zu stark. Korrekt wäre zunächst: „Kündigungen traten in der Gruppe mit längerer Lieferzeit häufiger auf; weitere Einflussfaktoren wurden noch nicht geprüft.“

Mit einem kleinen Referenzdatensatz prüfen

Bevor ein Team einen großen Monats- oder Jahresbestand analysiert, lohnt sich ein künstlicher Referenzdatensatz mit bereits bekannten Ergebnissen. Zehn bis zwanzig Zeilen reichen oft aus. Er enthält bewusst einen doppelten Schlüssel, einen leeren Wert, einen Ausreißer, zwei Datumsformate und eine Kategorie, die nur einmal vorkommt. Zusätzlich notiert das Team, welche Summe, welcher Mittelwert und welche Gruppierung korrekt sein müssen.

Das Werkzeug erhält danach dieselbe Art von Auftrag wie im echten Prozess. Erkennt es die vorbereiteten Probleme? Berechnet es die erwarteten Werte? Weist es auf Unsicherheit hin, wenn eine Spalte mehrdeutig ist? Dieser Test beweist nicht, dass jede spätere Analyse stimmt. Er zeigt aber früh, ob Anweisung, Import und Ausgabeformat grundlegende Kontrollen bestehen.

Für wiederkehrende Aufgaben bleibt der Referenzdatensatz als Regressionstest erhalten. Nach einer Änderung des Modells, der Tabellenstruktur oder des Prompts wird er erneut ausgeführt. Weicht ein erwarteter Wert ab, stoppt der Prozess vor dem echten Bericht. Besonders hilfreich sind Fälle, bei denen Null, leer und „nicht verfügbar“ unterschiedliche Bedeutungen haben.

Ergebnisse als prüfbare Tabelle ausgeben lassen

Eine lange Fließtext-Antwort erschwert die Kontrolle. Fordern Sie für jede zentrale Aussage eine strukturierte Ergebniszeile mit Kennzahl, Zeitraum, Filter, Ausgangsspalten, Rechenregel und Vertrauenshinweis an. Die Tabelle kann außerdem eine Spalte „Prüfstatus“ enthalten: ungeprüft, rechnerisch reproduziert, fachlich freigegeben oder verworfen.

Der Vertrauenshinweis darf dabei nicht als mathematische Wahrscheinlichkeit missverstanden werden, wenn das Werkzeug keine kalibrierte Wahrscheinlichkeit liefert. Nützlicher ist eine konkrete Begründung: „nur 14 Beobachtungen“, „drei Werte fehlen“ oder „Ergebnis ändert sich ohne größten Ausreißer“. Solche Hinweise führen direkt zu einer Prüfung.

Eine freigegebene Aussage verweist auf die gespeicherte Berechnung oder den Bereich, aus dem sie stammt. Wird daraus eine Präsentation oder E-Mail, bleibt diese Referenz intern erhalten. So kann eine Führungskraft bei Rückfragen von der Formulierung über die Kennzahl bis zu den ursprünglichen Zeilen zurückgehen.

Versionsstand und Aktualisierung dokumentieren

KI-Modelle und Tabellen ändern sich. Speichern Sie für einen wichtigen Analysepunkt:

  • Version und Hash oder eindeutigen Stand der Eingangsdaten,
  • verwendete Filter und Transformationen,
  • Formeln oder Abfragen,
  • Datum der Berechnung,
  • Werkzeug und wesentliche Anweisung,
  • Prüfperson und freigegebene Ergebnisfassung.

Eine dynamische KI-Ausgabe kann sich bei gleicher Frage verändern. Für wiederkehrende Berichte werden deshalb stabile Berechnungen gespeichert; die sprachliche Zusammenfassung kann neu erzeugt und wieder geprüft werden.

Ein Sieben-Schritte-Ablauf für eine sichere Tabellenanalyse

  1. Entscheidungsfrage, Kennzahl und Zeitraum festlegen.
  2. Datenklasse und freigegebenes Werkzeug prüfen.
  3. Rohdaten unverändert sichern und Arbeitstabelle bereinigen.
  4. Kontrollsummen und Baseline erzeugen.
  5. KI nur mit dem notwendigen Bereich und klarer Aufgabe verwenden.
  6. Formeln, Aussagen und Ausreißer unabhängig reproduzieren.
  7. Freigegebenen Stand samt Quellen, Version und Einschränkungen dokumentieren.

Für einen neuen Einsatz kann dieser Ablauf als begrenzter Test nach dem KI-Einsatzplan im Team durchgeführt werden. Erfolg bedeutet dann nicht nur eine schnellere Grafik, sondern weniger Gesamtaufwand bei gleicher oder besserer verifizierter Qualität.

Praxisbeispiel: Fehlzeiten nach Teams vergleichen

Eine Personalabteilung möchte Fehlzeiten nach Bereichen verstehen. Die Rohdatei enthält Namen, Personalnummern, Diagnosen und kleine Teams. Für den gewünschten Überblick sind viele Angaben nicht nötig und können besonders schutzwürdig sein.

Das Unternehmen klärt zuerst Zweck und zulässige Datenbasis. Es erstellt eine ausreichend aggregierte Tabelle ohne Namen und Diagnosen, prüft Mindestgruppengrößen und lässt Datenschutz sowie Betriebsrat den Prozess bewerten. Die Berechnung der Quoten erfolgt mit festen Formeln; die KI darf nur verständliche Beschreibungen der bereits geprüften Aggregate vorschlagen.

Im Review fällt auf, dass Teilzeitquoten zwischen Bereichen stark variieren. Die erste KI-Erklärung wird verworfen, weil sie diesen Kontext nicht kannte. Das Team ergänzt geeignete Bezugsgrößen und dokumentiert die Einschränkung. So verhindert die Fachprüfung eine voreilige Bewertung von Beschäftigten.

Typische Warnsignale

  • Die KI nennt Zahlen, aber keinen nachvollziehbaren Filter oder Rechenweg.
  • Zeilenzahl und Kontrollsummen fehlen.
  • Ein Diagramm nutzt abgeschnittene Achsen oder uneinheitliche Zeiträume.
  • Null, leer und „nicht anwendbar“ werden gleich behandelt.
  • Eine Korrelation wird als Ursache formuliert.
  • Personenbezogene Daten wurden nur optisch ausgeblendet.
  • Die Ergebnisdatei überschreibt die Rohdaten.
  • Niemand kann den Befund ohne denselben Chat reproduzieren.

Häufige Fragen zu KI und Tabellen

Darf KI Formeln erstellen?

Ja, als Vorschlag. Die Formel muss fachlich, technisch und an Grenzfällen geprüft werden. Für wichtige Zahlen sollte der Rechenweg unabhängig reproduzierbar sein.

Kann ich eine ganze Arbeitsmappe hochladen?

Nur wenn Werkzeug, Datenklasse und Zweck das ausdrücklich erlauben. Meist ist ein bereinigter Ausschnitt sicherer. Versteckte Blätter, Kommentare und Metadaten müssen mitgedacht werden.

Wie erkenne ich eine plausible, aber falsche Analyse?

Durch Kontrollsummen, Rückrechnung, Stichproben, Gegenhypothesen und Fachreview. Eine gute Formulierung oder schöne Grafik ist kein Qualitätsnachweis.

Welche Zahlen sollte die KI nicht allein erzeugen?

Abschluss-, Lohn-, Steuer-, Rechts- oder andere folgenreiche Zahlen gehören in kontrollierte, reproduzierbare Verfahren. KI kann erklären und vorbereiten, aber nicht die verbindliche Prüfung ersetzen.

Fazit: Jede Erkenntnis braucht einen Rückweg zur Zelle

KI kann Tabellenarbeit beschleunigen, wenn Berechnung, Beobachtung und Interpretation sauber getrennt bleiben. Der wichtigste Schutz ist ein unverändertes Original plus ein Kontrollblatt, das Umfang und Summen über jeden Schritt hinweg absichert.

Nehmen Sie eine häufige Analyse und dokumentieren Sie Zeilenzahl, Zeitraum, Kontrollsumme und drei Grenzfälle. Lassen Sie die KI anschließend nur einen klar begrenzten Teil unterstützen. Wenn jede Aussage auf geprüfte Zellen, Formeln und Quellen zurückgeführt werden kann, entsteht aus einer schnellen Antwort ein belastbares Arbeitsergebnis.

Sources and further information