Zum Inhalt springen

KI-fähige Daten beginnen mit der Geschäftsentscheidung, nicht mit dem Modell.

Jede Organisation möchte ihre Daten für KI vorbereiten.

Aber worauf sind wir bereit?

Ein Wissensassistent für Unternehmen benötigt andere Daten als ein Betrugsmodell. Ein Kundendienstmitarbeiter hat andere Anforderungen als ein … autonomer Agent Diese Anwendung kann Datensätze aktualisieren oder Rückerstattungen veranlassen. Eine Anwendung zur abrufgestützten Datengenerierung (RAG) benötigt möglicherweise aktuelle interne Dokumente, während ein prädiktives Modell auf jahrelang sorgfältig aufbereiteten historischen Daten basieren kann.

Damit ist die Anforderung “KI-fähige Daten” unvollständig, solange die Organisation nicht definiert, was die KI leisten soll.

Bevor sich Datenverantwortliche fragen, ob Daten bereit für KI sind, sollten sie sich Folgendes fragen:

Welche Geschäftsentscheidungen, Aufgaben oder Arbeitsabläufe wird KI verändern, und welche Daten benötigt sie tatsächlich, um dies sicher und effektiv zu tun?

Diese Frage wandelt die KI-Bereitschaft von einer breit angelegten Datenbereinigungsmaßnahme in ein messbares Geschäftsprogramm.

KI-fähige Daten sollten sein Geeignet für den vorgesehenen Zweck, ausreichend vertrauenswürdig für die anstehende Entscheidung, angemessen geregelt, für die richtigen Identitäten und KI-Systeme zugänglich, entsprechend seiner Sensibilität geschützt und mit einem nachvollziehbaren Geschäftsergebnis verbunden.

Für CDOs schafft dies einen nützlicheren Ausgangspunkt:

Geschäftsergebnis → Entscheidung oder Workflow → KI-Anwendungsfall → Daten → Kontrollen → Messbarer Wert

KI-fähige Daten: Wichtigste Erkenntnisse

- Die Bereitschaft für KI beginnt mit einem Geschäftsergebnis. Definieren Sie die Entscheidung, Aufgabe oder den Arbeitsablauf, den die KI ändern muss, bevor Sie entscheiden, welche Daten die Initiative benötigt.

- KI-fähig bedeutet nicht, dass alle Unternehmensdaten geeignet sind. Unterschiedliche Anwendungsfälle von KI erfordern unterschiedliche Daten, Aktualität, Qualität, Kontext, Berechtigungen und Kontrollmechanismen.

- Verfügbare Daten sind nicht unbedingt geeignete Daten. Daten können zwar technisch zugänglich sein, sind aber möglicherweise zu sensibel, ungenau, veraltet, übermäßig exponiert, eingeschränkt oder für eine bestimmte KI-Anwendung irrelevant.

- KI-Agenten erhöhen die Anforderungen an die Einsatzbereitschaft. Organisationen müssen nicht nur regeln, welche Daten ein Agent abrufen kann, sondern auch, was er mit diesen Daten durch Anwendungen, APIs, Tools und Workflows tun kann.

- Der Kontext bestimmt die Fitness. Sensibilität, Qualität, Herkunft, Eigentumsverhältnisse, Zugriff, Richtlinien, geschäftliche Bedeutung und Verwendungszweck beeinflussen allesamt, ob Daten für KI geeignet sind.

- BigID verbindet die KI-Bereitschaft mit der operativen Steuerung. BigID entdeckt, klassifiziert, katalogisiert, kuratiert und verwaltet Unternehmensdaten und verbindet dabei KI mit Herkunft, Zugriff, Eigentum, Richtlinien, Risiken und Abhilfemaßnahmen.

Was sind KI-fähige Daten?

KI-fähige Daten sind Daten, die für einen definierten KI-Anwendungsfall geeignet, vertrauenswürdig, kontextualisiert, zugänglich, reguliert und geschützt sind.

Die Worte definierter KI-Anwendungsfall Gegenstand.

Es gibt keinen universellen Zustand, in dem Unternehmensdaten plötzlich “KI-fähig” werden.”

Ein Datensatz kann für ein internes Prognosemodell geeignet sein, jedoch nicht für eine externe generative KI-Anwendung. Ein Kundendatensatz mag für die Marktsegmentierung ausreichend genau sein, aber für eine automatisierte Kreditentscheidung nicht zuverlässig genug. Ein Dokument kann für die Unternehmenssuche nützlich sein, gleichzeitig aber sensible Informationen enthalten, auf die ein bestimmter Mitarbeiter oder KI-Agent niemals zugreifen sollte.

Die KI-Einsatzbereitschaft hängt daher sowohl von den Daten als auch von deren beabsichtigtem Verwendungszweck ab.

Organisationen sollten Folgendes verstehen:

  • Welche Daten existieren und wo sind sie gespeichert?
  • Was die Daten bedeuten
  • Ob es genau ist und für den beabsichtigten Zweck geeignet ist
  • Woher es kam und wie Teams es transformiert haben
  • Ob es sensible oder regulierte Informationen enthält
  • Wem gehört es?
  • Welche Richtlinien und Einschränkungen gelten
  • Wer oder was kann darauf zugreifen?
  • Ob einem KI-System die Verwendung gestattet werden sollte
  • Wie die KI diese Informationen abruft, verarbeitet, generiert oder darauf reagiert

Dies macht die KI-Bereitschaft sowohl zu einem Datenverwaltung Es handelt sich um ein Problem und ein Geschäftsproblem.

Daten für KI im Unternehmen aufbereiten

Schaffen Sie einen vertrauenswürdigen Pfad von Unternehmensdaten zu KI

Entdecken, klassifizieren, kuratieren, bereinigen und verwalten Sie die Daten, die für KI-Training, -Optimierung, -Abruf, -Inferenz und KI-Workflows in Unternehmen verwendet werden.

Entdecken Sie sichere KI-Datenpipelines →

Warum “Wir brauchen KI” keine Geschäftsanforderung ist

Organisationen beginnen KI-Programme routinemäßig mit Aussagen wie:

  • “Wir brauchen GenAI.”
  • “Wir brauchen einen unternehmensweiten Kopiloten.”
  • “Wir brauchen Agenten.”
  • “Wir brauchen eine Ampelarchitektur.”
  • “Wir müssen unsere Daten KI-fähig machen.”

Jede Aussage beschreibt eine Technologie oder Fähigkeit.

Keine der Erklärungen behandelt das Geschäftsproblem.

Diese Unterscheidung ist wichtig, weil die Geschäftsproblematik bestimmt, welche KI-Architektur, welche Daten, welche Kontrollmechanismen und welche Investitionen sinnvoll sind.

Stellen Sie sich eine Kundendienstorganisation vor, die einen generativen KI-Assistenten anfordert.

Die gestellte Anfrage lautet:

“Wir brauchen einen Copiloten für den Kundenservice.”

Das zugrundeliegende Bedürfnis könnte tatsächlich sein:

“Die Agenten verbringen zu viel Zeit mit der Suche in fünf Wissenssystemen, was die durchschnittliche Bearbeitungszeit erhöht und zu inkonsistenten Ergebnissen führt.”

Die Initiative verfügt nun über einen Arbeitsablauf, einen Benutzer, ein Problem und ein potenzielles Ergebnis.

Die Organisation kann bessere Fragen stellen:

  • Welche Wissensquellen benötigen Servicemitarbeiter?
  • Welche Quellen liefern verlässliche Antworten?
  • Wie aktuell müssen die Informationen sein?
  • Welche Kundeninformationen kann der Copilot abrufen?
  • Welche Datensätze enthalten sensible Informationen?
  • Sollen alle Abgeordneten die gleichen Daten einsehen können?
  • Wie werden die Teams die Qualität der Antworten messen?
  • Welche Aktionen erfordern die Zustimmung eines Menschen?
  • Bedeutet Erfolg kürzere Bearbeitungszeiten, eine bessere Lösungsfindung beim Erstkontakt, eine höhere Kundenzufriedenheit oder eine Kombination daraus?

Die Geschäftsanforderungen bestimmen die Datenanforderungen, nicht umgekehrt.

Das Business-First-KI-Bereitschaftsframework

Ein sinnvoller KI-Bereitschaftsprozess geht von der Geschäftsabsicht in Richtung Technologie, anstatt mit einem Modell oder einer Datenplattform zu beginnen.

Das Business-First-KI-Bereitschaftsframework

Beginnen Sie mit dem Ergebnis. Arbeiten Sie sich dann rückwärts zu den Daten vor.

1. ErgebnisWelches messbare Geschäftsergebnis muss sich ändern?
2. ArbeitsablaufWelche Entscheidung, Aufgabe oder welcher Prozess muss anders ablaufen?
3. KIWelche Rolle sollte KI in diesem Arbeitsablauf spielen?
4. DatenWelche Daten benötigt KI tatsächlich?
5. BedienelementeWelche Qualitäts-, Zugriffs-, Datenschutz-, Sicherheits- und Governance-Kontrollen gelten?
6. WertWie wird die Organisation die Wirkung messen und aufrechterhalten?

Grundprinzip: Die KI-Bereitschaft ist kontextabhängig. Dieselben Daten können für einen KI-Anwendungsfall geeignet sein, für einen anderen jedoch ungeeignet.

Nicht jeder Anwendungsfall von KI erfordert das gleiche Maß an Kontrolle. Je sensibler die Daten, je autonomer die Handlung oder je folgenreicher die Entscheidung, desto strenger sollten die Anforderungen an Zugang, Aufsicht, Beweisführung und Abhilfemaßnahmen sein.

Sechs Fragen, die Sie sich vor der Datenaufbereitung für KI stellen sollten

1. Welche Entscheidung, Aufgabe oder welchen Arbeitsablauf wird KI verändern?

Vermeiden Sie es, mit “Wir wollen KI-gestützte Erkenntnisse” zu beginnen.”

Identifizieren Sie, was jemand oder etwas anders machen wird.

Wird KI:

  • Kundenfälle zusammenfassen?
  • Empfehlen Sie Änderungen am Lagerbestand?
  • Softwarecode generieren?
  • Geräteausfälle vorhersagen?
  • Interne Richtlinien abrufen?
  • Betrug aufdecken?
  • Verträge prüfen?
  • Autonome Aktionen über Unternehmensanwendungen hinweg ausführen?

Ein abgegrenzter Arbeitsablauf ermöglicht es, die minimal erforderlichen Daten und die relevanten Kontrollmechanismen zu identifizieren.

2. Wie wird die Organisation ihren Erfolg messen?

Definieren Sie die Ausgangslage, bevor Sie KI einsetzen.

Je nach Anwendungsfall kann Erfolg beispielsweise Folgendes umfassen:

  • Kürzere Bearbeitungszeit
  • Weniger Fehler
  • Höhere Konversionsrate
  • Niedrigere Betriebskosten
  • Schnellere Kundenreaktion
  • Verbesserte Erkennung
  • Reduzierte manuelle Überprüfung
  • Geringeres Expositionsrisiko

Ohne eine Ausgangsbasis und ein Ziel können Teams zwar die Modellleistung messen, bleiben aber weiterhin nicht in der Lage, die Geschäftsleistung nachzuweisen.

3. Welche Daten benötigt die KI tatsächlich?

KI-Initiativen können Druck erzeugen, so viele Daten wie möglich zu sammeln.

Mehr ist nicht automatisch besser.

Teams sollten die minimalen Informationen ermitteln, die zur Erzielung des angestrebten Ergebnisses erforderlich sind, und Folgendes bestimmen:

  • Erforderliche Geschäftseinheiten
  • Autoritative Quellen
  • Erforderliche historische Tiefe
  • Erforderliche Frische
  • Relevante strukturierte und unstrukturierte Inhalte
  • Akzeptable Qualitätsschwellenwerte
  • Sensible oder regulierte Bereiche
  • Daten, die außerhalb des Anwendungsfalls bleiben sollten

Entdeckung und Klassifizierung Sie liefern entscheidenden Kontext, denn Organisationen können keine fundierten Entscheidungen über KI-Daten treffen, die sie nicht finden oder verstehen können.

4. Welche Daten sollte die KI nicht verwenden?

Diese Frage verdient das gleiche Gewicht.

Die für KI verfügbaren Daten sind nicht unbedingt für KI geeignet.

Ein Unternehmensrepository kann Folgendes enthalten:

  • PII
  • PHI
  • Finanzinformationen
  • Zugangsdaten und Geheimnisse
  • Geistiges Eigentum
  • Rechtsdokumente
  • Mitarbeiterakten
  • Eingeschränkte Kommunikation
  • Veraltete oder doppelte Informationen
  • Inhalte ohne gültigen Geschäftszweck für den KI-Anwendungsfall

Die Bereitschaft für KI erfordert daher sowohl Ausschluss als auch Einschluss.

Organisationen benötigen Mechanismen, um ungeeignete Daten zu klassifizieren, zu minimieren, zu redigieren, unter Quarantäne zu stellen, einzuschränken oder auf andere Weise zu steuern, bevor sie Trainingsdatensätze, RAG-Pipelines, Eingabeaufforderungen, Modelle oder Agenten erreichen.

Der aktuelle Ansatz von BigID zur sicheren KI-Pipeline folgt diesem Muster, indem er Unternehmensdaten erkennt und klassifiziert und anschließend Bereinigungs- und richtlinienbasierte Kontrollen unterstützt, bevor die Daten in die KI-Workflows gelangen.

5. Was passiert, wenn die KI einen Fehler macht?

Die akzeptable Fehlertoleranz hängt vom Anwendungsfall ab.

Ein unvollkommener Entwurf einer internen E-Mail birgt ein anderes Risikoprofil als eine falsche medizinische Empfehlung, eine falsche finanzielle Entscheidung, eine Änderung der Zugriffsrechte oder eine automatische Löschung.

Teams sollten Folgendes festlegen:

  • Akzeptable Fehlerschwellen
  • Erforderliche menschliche Überprüfung
  • Eskalationskriterien
  • Eingeschränkte Aktionen
  • Nachweis- und Prüfungsanforderungen
  • Verantwortlichkeit für Ergebnisse

Je größer die potenziellen Auswirkungen, desto strenger sollten die Anforderungen an Daten, Zugang, Governance und menschliche Aufsicht sein.

6. Wem gehört das Ergebnis?

KI kann nicht allein in der Verantwortung des Datenteams liegen, da das Datenteam selten für den zugrunde liegenden Geschäftsprozess verantwortlich ist.

Ein Geschäftsinhaber sollte für das Ergebnis verantwortlich bleiben.

Teams aus den Bereichen Daten, KI, Sicherheit, Datenschutz, Recht, Risikomanagement und Technologie können Kontrollmechanismen einrichten und Fachwissen bereitstellen, aber jemand muss die Verantwortung für die von der KI unterstützte Entscheidung übernehmen und feststellen, ob der daraus resultierende Prozess eine akzeptable Geschäftsleistung liefert.

Was macht Daten tatsächlich KI-fähig?

Sobald der Anwendungsfall klar ist, können die Teams die Daten anhand spezifischer Bereitschaftsdimensionen auswerten.

Der KI-fähige Datentest

Die Einsatzbereitschaft hängt davon ab, ob die Daten das angestrebte KI-Ergebnis mit dem erforderlichen Vertrauen und der notwendigen Kontrolle unterstützen können.

Dimension Frage und Antwort
Relevanz Tragen diese Daten zur angestrebten Entscheidung oder zum angestrebten Arbeitsablauf bei?
Qualität Sind die Daten für diesen Zweck ausreichend genau, vollständig, konsistent und aktuell?
Bedeutung Verfügen Teams und KI-Systeme über genügend Geschäftskontext, um die Daten korrekt zu interpretieren?
Herkunft Wissen wir, woher die Daten stammen und wie sie sich verändert haben?
Empfindlichkeit Enthält es regulierte, vertrauliche, persönliche, geschützte oder eingeschränkte Informationen?
Zugang Soll dieser Benutzer, dieses Modell, diese Anwendung oder dieser Agent es erreichen können?
Politik Entsprechen Nutzung, Standort, Aufbewahrung und Verarbeitung den geltenden Richtlinien?
Eigentum Wer kann die Verwendung genehmigen und bleibt dafür verantwortlich?

KI-fähige Daten sind mehr als nur Datenqualität

Die Datenqualität ist wichtig, aber allein die Qualität reicht nicht aus, um die KI-Bereitschaft zu gewährleisten.

Selbst ein absolut akkurater Kundendatensatz kann personenbezogene Daten enthalten, zu deren Verarbeitung eine KI-Anwendung keinen legitimen Grund hat.

Die aktuellen Mitarbeiterdokumente könnten immer noch Berechtigungen enthalten, die vertrauliche Informationen einem allgemein verfügbaren Copiloten zugänglich machen.

Eine saubere RAG-Quelle kann dennoch unzureichende Herkunftsangaben aufweisen, um den Ursprung der Informationen zu bestimmen.

Ein technisch korrekter Datensatz kann eine Definition von “Kunde” verwenden, die im Widerspruch zu dem Geschäftsprozess steht, den die KI unterstützen soll.

Für KI-fähige Daten sind neben der Datenqualität vor allem Eignung, Kontext und Kontrolle erforderlich.

Deshalb KI-Datenkatalog kann eine wichtige Rolle spielen. Der aktuelle Katalogansatz von BigID erweitert den Datenkontext auf KI-Trainingsdaten, unstrukturierte Inhalte, RAG-Quellen, Vektorspeicher und modellbezogene Daten und verknüpft dabei Sensitivitäts-, Eigentums-, Herkunfts-, Richtlinien- und Qualitätssignale.

Wie agentenbasierte KI die Datenverfügbarkeit verändert

Generative KI hat Organisationen zu folgenden Fragen veranlasst:

Welche Daten kann KI erfassen?

Agentic AI wirft eine weitere Frage auf:

Was kann die KI tun, sobald sie es sieht?

Ein KI-Agent kann Informationen abrufen und anschließend Tools verwenden, APIs aufrufen, mit Anwendungen interagieren, Datensätze ändern, Arbeitsabläufe auslösen, extern kommunizieren oder andere Aktionen initiieren.

Dadurch wandelt sich die Datenverfügbarkeit in ein Zugriffs- und Berechtigungsproblem.

Ein Agent kann über folgende Wege Zugriff erhalten:

  • Anwendungsberechtigungen
  • Servicekonten
  • Maschinenidentitäten
  • OAuth-Bereiche
  • Cloud-Rollen
  • API-Zugangsdaten
  • Delegierte Benutzerberechtigungen

Organisationen müssen daher den KI-Anwendungsfall mit folgenden Elementen verknüpfen: KI-Zugriffsverwaltung und am wenigsten privilegiert.

Die Frage ist nicht mehr einfach nur, ob die zugrunde liegenden Daten für KI geeignet sind.

Die Teams müssen außerdem feststellen, ob die KI-Identität über angemessene Zugriffsrechte verfügt und ob ihre verfügbaren Aktionen ihrem genehmigten Geschäftszweck entsprechen.

KI-fähige Daten für RAG

RAG macht die Frage der Bereitschaft besonders konkret.

Eine RAG-Anwendung ruft Unternehmensinformationen zum Zeitpunkt der Inferenz ab und stellt diesen Kontext einem generativen KI-System zur Verfügung.

Das bedeutet, dass die Qualität des Erlebnisses von mehr als nur dem Modell abhängt.

Organisationen sollten Folgendes bewerten:

  • Welche Repositorien speisen die Datenabfrage?
  • Ob die Quelleninhalte aktuell und maßgebend bleiben
  • Ob die Dokumente sensible Informationen enthalten
  • Ob Berechtigungen nach der Indizierung weiterhin angemessen sind
  • Ob verschiedene Benutzer unterschiedliche Inhalte abrufen sollten
  • Wie Einbettungen und Vektorspeicher gesteuert werden
  • Ob die Herkunftsanalyse die abgerufenen Inhalte mit ihrer Quelle verbindet
  • Wie Richtlinien für Eingabeaufforderungen und Antworten gelten

Ein RAG-System sollte nicht aus “Die KI kann es finden” ein “Jeder kann es sehen” machen.”

Das macht Datenfindung, Klassifizierung, Herkunftsnachverfolgung, Zugriffskontext und Richtliniendurchsetzung zu grundlegenden Bestandteilen der RAG-Bereitschaft.

Wissen Sie, was Ihre KI antreibt?

Verbinden Sie KI-Systeme mit den Daten, dem Zugriff und dem Kontext, die ihnen zugrunde liegen.

Entdecken Sie KI-Assets, klassifizieren Sie sensible Daten, bilden Sie Herkunft und Zugriff ab, setzen Sie Richtlinien durch, bewerten Sie Risiken und sammeln Sie Beweise über Modelle, Agenten, Copiloten, Datensätze, Eingabeaufforderungen und Pipelines hinweg.

Mehr über KI-Sicherheit und -Governance erfahren →

Ein praktisches Beispiel: Von “Wir brauchen KI” zu einem KI-fähigen Anwendungsfall

Stellen Sie sich eine Vertriebsorganisation vor, die ein KI-System zur Identifizierung von Kundenkonten mit Abwanderungsrisiko anfordert.

Die technologieorientierte Version klingt folgendermaßen:

“Wir brauchen ein KI-gestütztes Abwanderungsmodell.”

Eine Version mit Fokus auf Geschäftskunden sieht anders aus:

Geschäftsergebnis: Verbesserung der Kundenbindung bei wichtigen Kunden.

Arbeitsablauf: Geben Sie den Account Managern genügend Vorwarnung, damit sie eingreifen können, bevor das Verlängerungsrisiko unumkehrbar wird.

Rolle der KI: Identifizieren Sie Signale, die mit einem erhöhten Verlängerungsrisiko verbunden sind, und priorisieren Sie die zu überprüfenden Konten.

Erforderliche Daten: Vertragsdaten, Produktnutzung, Supportfälle, Kontohistorie, Kundeninteraktion und relevante Kundenattribute.

Datenanforderungen: Aktuelle Produktnutzung, zuverlässiges Account-Matching, vereinbarte Definitionen von Kundenabwanderung und Account-Status, ausreichende historische Daten, dokumentierte Herkunft und angemessener Umgang mit sensiblen Kundendaten.

Bedienelemente: Zugriffe regeln, unnötige personenbezogene Daten einschränken, Datenquellen dokumentieren, Qualität überwachen, Eigentumsverhältnisse klären und vor Kundenmaßnahmen menschliches Urteilsvermögen fordern.

Erfolg: Früheres Eingreifen, höhere Kundenbindung im Zielsegment und messbare Akzeptanz durch die Account-Teams.

Beachten Sie, was passiert ist.

Die Organisation begann nicht damit, jeden Kundendatensatz KI-fähig zu machen.

Es identifizierte die kleinste verwaltete Datenbasis, die in der Lage ist, das Geschäftsergebnis zu verändern.

Das ist eine wesentlich praxisorientiertere Definition von Bereitschaft.

Die KI-Bereitschaft sollte kontinuierlich sein.

Die Daten bleiben nicht unbegrenzt verfügbar.

Quellen ändern sich. Definitionen ändern sich. Die Qualität sinkt. Neue sensible Informationen tauchen auf. Berechtigungen häufen sich. Vorschriften und interne Richtlinien entwickeln sich weiter. KI-Anwendungen werden integriert. Mitarbeiter erhalten neue Werkzeuge.

Organisationen müssen daher kontinuierlich evaluieren:

  • Qualität der Daten
  • Empfindlichkeit
  • Abstammung
  • Eigentum
  • Zugang
  • Verwendung
  • Einhaltung der Richtlinien
  • KI-Risiko

Dadurch wird die KI-Bereitschaft von einer Checkliste vor dem Marktstart zu einer operativen Disziplin.

Wie BigID KI-fähige Daten angeht

BigID geht bei der KI-Bereitschaft von den Daten aus und behält dabei den geschäftlichen Nutzen dieser Daten im Kontext.

BigID unterstützt Organisationen:

  • Unternehmensdaten entdecken und klassifizieren: Identifizieren Sie strukturierte, unstrukturierte, sensible, regulierte, vertrauliche, geschützte und geschäftskritische Informationen in den unterstützten Unternehmensumgebungen.
  • Katalogisieren und kontextualisieren Sie KI-Daten: Die Daten werden mit Angaben zu Sensibilität, Eigentumsverhältnissen, geschäftlicher Bedeutung, Herkunft, Qualität, Richtlinien und anderen für den KI-Einsatz erforderlichen Metadaten angereichert.
  • KI-Datenpipelines vorbereiten: Daten, die für Training, Optimierung, Abruf, Inferenz und andere KI-Workflows verwendet werden, entdecken, klassifizieren, bereinigen und kontrollieren.
  • Entdecken Sie KI-Ressourcen: Identifizieren Sie Modelle, Agenten, Copiloten, Eingabeaufforderungen, Datensätze, Vektorspeicher, Pipelines, Anwendungen, KI von Drittanbietern und Schatten-KI.
  • Herkunft der Map AI-Daten: Verstehen Sie, wie Daten durch Training, Optimierung, Abruf, Eingabeaufforderung, Inferenz und nachgelagerte Arbeitsabläufe fließen.
  • KI-Zugang steuern: Verknüpfen Sie KI-Systeme und Identitäten mit Berechtigungen und sensiblen Unternehmensdaten, um einen angemessenen Zugriff und das Prinzip der minimalen Berechtigungen zu gewährleisten.
  • KI-Risiken priorisieren: Verknüpfen Sie KI-Risiken mit Datensensibilität, Zugriff, Nutzung, Eigentum, Herkunft, Richtlinien und potenziellen Auswirkungen auf das Geschäft.
  • Handeln Sie: Koordinieren Sie Abhilfemaßnahmen, wenn Daten, Zugriff, Qualität, Offenlegung oder politische Rahmenbedingungen Informationen für den Einsatz mit KI ungeeignet machen.

Der aktuelle Ansatz von BigID im Bereich KI-Sicherheit und -Governance verknüpft KI-Systeme mit sensiblen Daten, Identitäten, Berechtigungen, Eigentumsverhältnissen, Herkunft, Richtlinien, Geschäftskontext, Risiken und Nachweisen, anstatt die Erfassung des KI-Inventars als Endziel zu betrachten.

Ziel ist es nicht, jedes Byte an Unternehmensdaten für jedes KI-System aufzubereiten. Vielmehr geht es darum, die richtigen Daten für den jeweiligen KI-Einsatz zu identifizieren und zu steuern – mit dem Kontext und den Kontrollen, die für ein verlässliches Geschäftsergebnis erforderlich sind.

Die Punkte zwischen Daten und KI verbinden

Unternehmensdaten in vertrauenswürdige, KI-fähige Daten umwandeln

Erfahren Sie, wie BigID Unternehmensdaten entdeckt, klassifiziert, katalogisiert, kuratiert und verwaltet und gleichzeitig KI mit Herkunft, Zugriff, Eigentum, Richtlinien, Risiken und Abhilfemaßnahmen verbindet.

Siehe BigID für KI-fähige Daten →

Häufig gestellte Fragen zu KI-fähigen Daten

Was sind KI-fähige Daten?

KI-fähige Daten sind Daten, die für einen definierten KI-Anwendungsfall geeignet, vertrauenswürdig, kontextbezogen, zugänglich, reguliert und geschützt sind. Die Eignung kann Relevanz, Qualität, Sensibilität, Herkunft, Eigentumsverhältnisse, Zugriff, Richtlinien und Geschäftskontext umfassen.

Wie bereitet man Daten für KI auf?

Definieren Sie zunächst das Geschäftsergebnis und den Anwendungsfall für KI. Ermitteln Sie anschließend die minimal erforderlichen Daten, finden und klassifizieren Sie diese, bewerten Sie Qualität und Relevanz, klären Sie Herkunft und Eigentumsverhältnisse, regeln Sie den Zugriff, wenden Sie Datenschutz- und Sicherheitsrichtlinien an, gehen Sie gegen unzulässige Daten vor und überwachen Sie kontinuierlich die Einsatzbereitschaft.

Müssen KI-fähige Daten perfekt sein?

Nein. Daten müssen den Qualitäts- und Vertrauenswürdigkeitsanforderungen ihres Verwendungszwecks entsprechen. Verschiedene KI-Anwendungen haben unterschiedliche Toleranzen gegenüber Fehlern, fehlenden Informationen, Aktualität und Unsicherheit. Der angemessene Standard hängt von der jeweiligen Entscheidung und ihren potenziellen Auswirkungen ab.

Ist Datenqualität dasselbe wie KI-Bereitschaft?

Nein. Datenqualität ist zwar ein Bestandteil der KI-Bereitschaft, aber selbst hochwertige Daten können aufgrund von Sensibilität, Zugriffsbeschränkungen, Richtlinienvorgaben, fehlender Herkunftsnachweise oder mangelnder Geschäftsrelevanz für KI-Anwendungen ungeeignet sein.

Warum ist Daten-Governance für KI wichtig?

Data Governance legt Kontext, Verantwortlichkeiten, Richtlinien, Eigentumsverhältnisse, Qualitätsanforderungen, Datenherkunft und angemessene Nutzung fest. Diese Kontrollmechanismen helfen Organisationen zu bestimmen, welche Unternehmensdaten KI-Systeme unter welchen Bedingungen nutzen dürfen.

Welche Daten sollten nicht für KI verwendet werden?

Die Antwort hängt vom Anwendungsfall und den geltenden Anforderungen ab. Organisationen sollten prüfen, ob sensible, regulierte, vertrauliche, geschützte, eingeschränkte, ungenaue, veraltete, irrelevante oder anderweitig ungeeignete Informationen in einen KI-Workflow einfließen sollten.

Wie beeinflusst RAG die Datenbereitschaft im Bereich KI?

RAG verbindet KI-Anwendungen mit Unternehmensinformationen zum Zeitpunkt der Inferenz. Organisationen müssen Quellinhalte, Sensibilität, Aktualität, Zugriff, Herkunft, Vektorspeicher, Abrufberechtigungen, Abfragen und Antworten steuern, damit beim Abruf keine ungeeigneten Daten offengelegt werden.

Wie verändern KI-Agenten die Datenverfügbarkeit?

KI-Agenten können über Tools, APIs, Anwendungen und Workflows Daten abrufen und Aktionen ausführen. Organisationen müssen daher sowohl die Informationen, auf die Agenten zugreifen können, als auch die Aktionen, die ihnen aufgrund ihrer Identität und Berechtigungen gestattet sind, regeln.

Wie trägt BigID dazu bei, Daten KI-fähig zu machen?

BigID unterstützt Unternehmen bei der Ermittlung, Klassifizierung, Katalogisierung, Kontextualisierung, Kuratierung und Verwaltung von Unternehmensdaten und verknüpft KI-Ressourcen mit sensiblen Daten, Herkunft, Eigentumsverhältnissen, Identität, Zugriffsrechten, Richtlinien, Risiken und Maßnahmen zur Datenbehebung. Darüber hinaus unterstützt BigID die Datenkontrolle in den Bereichen KI-Training, -Optimierung, -Abruf, -Inferenz und anderen KI-Workflows im Unternehmen.

Inhalt

Checkliste zur KI-Bereitschaft

In vielen Organisationen schreitet die Einführung von KI schneller voran als die entsprechenden Steuerungsmaßnahmen. Diese Checkliste bietet Verantwortlichen für Sicherheit, Datenschutz und Datenmanagement wichtige Schritte – von der Identifizierung bis zur Durchsetzung von Richtlinien –, um diese Lücke zu schließen.

Laden Sie die Checkliste zur KI-Bereitschaft herunter