In dieser Episode von Above C Level sprechen Kerstin und Wolfgang über die unterschätzte Bedeutung der Datenhygiene für KI und darüber, warum Schritte wie das Anonymisieren und Klassifizieren von Trainingsdaten so komplex sind, aber rechtlich wie technisch unverzichtbar. Zudem erfahren Sie Best Practices, um Datenmüll effizient zu reduzieren und Modelle auf ein solides Fundament zu stellen.
Links:
Intelligente Governance inkl. DLP von Komprise
Automatisiertes Data-Management mit Data Dynamics oder Arcitecta
Das Agenten-OS mit Kontext von Alation
Pro-Tipp: Wichtige Kriterien für die Auswahl können sein, ob eine Plattform auch on-prem betrieben werden kann, mandantenfähig ist, eigene AI- und Sprachmodelle (Large Language Modell, LLM) genutzt werden können (Bring your own AI) oder ob eine Vollindexierung gemacht wird bzw. nur die Metadaten indexiert werden. Letztes macht die Plattformen zwar schneller aber nicht unbedingt genauer.