Es ist ein bekanntes Muster: Ein mittelständisches Unternehmen investiert in ein KI-gestütztes VertriebsÂtool â Lead-Scoring, Next-Best-Action, automatisierte Segmentierung. Die Demo überzeugt, der Pilot läuft an, die ersten Ergebnisse enttäuschen. UrsachenÂanalyse: Das Modell hat nicht versagt. Die Daten haben es nie arbeiten lassen.
Das Fundament, das niemand prüft
Gartner beziffert in seinem Data Quality Market Survey 2024 den durchschnittlichen finanziellen Schaden mangelhafter Datenqualität auf rund 12,9 Millionen US-Dollar pro Jahr und Unternehmen â über alle Branchen. Für den B2B-Vertrieb im Mittelstand ist der Wert absolut niedriger, relativ aber oft gravierender: Kleinere Vertriebsteams haben weniger Kapazität, DatenÂlücken manuell zu kompensieren. Forrester Research kommt in seinem B2B Data Health Benchmark 2024 zu einem ähnlichen Befund: In typischen CRM-Instanzen mittelständischer B2B-Unternehmen sind zwischen 40 und 60 Prozent der Kontaktdatensätze in mindestens einem vertriebsrelevanten Feld unvollständig, veraltet oder inkonsistent. Branchenkennzeichnung fehlt, EntscheiderÂrollen sind nicht gepflegt, TelefonÂnummern stammen aus dem Erstgespräch vor drei Jahren.
Das Salesforce State of Sales Report 2024 ergänzt die Perspektive der Anwender: Rund zwei Drittel der befragten VertriebsÂmitarbeiter zweifeln an der Qualität der Daten, mit denen KI-Empfehlungen in ihrem CRM generiert werden. Vertrauen in die Ausgabe des Systems entsteht nicht â und damit auch keine VerhaltensÂänderung.
Warum KI-Modelle Datenmängel nicht selbst heilen
Ein verbreiteter Irrtum: KI werde das schon richten. Tatsächlich verstärken viele Modelle systematische Datenlücken eher, als sie zu schlieÃen. Ein Lead-Scoring-Algorithmus, der auf historischen Abschlüssen trainiert wurde, repliziert die Verzerrungen jener Abschlüsse â inklusive der Branchen, die im CRM nicht sauber klassifiziert waren. McKinsey hält im State of AI 2025 fest, dass Unternehmen, die KI im Vertrieb nutzen, ohne zuvor eine Datenstrategie zu etablieren, im Schnitt nur rund 30 Prozent der erwarteten ProduktivitätsÂgewinne realisieren. Der Rest versickert in KorrekturÂschleifen, manuellem Nachpflegen und sinkender NutzerÂakzeptanz.
IDC dokumentiert in der European CRM Adoption Study 2025, dass nur etwa ein Viertel der mittelständischen CRM-Nutzer in der DACH-Region ein formales DatenÂgovernance-Konzept betreibt â also definierte Verantwortlichkeiten, PflichtÂfelder, ValidierungsÂregeln und regelmäÃige DatenÂbereinigungszyklen. Der Rest vertraut darauf, dass die Vertriebsmitarbeiter es schon richtig eintragen. Das tun sie nicht â nicht weil sie nachlässig sind, sondern weil ein AuÃendienstler zwischen zwei Terminen keine Zeit hat, Postleitzahlen zu normieren.
Drei Hebel, die Abhilfe schaffen â ohne groÃes Projekt
Die gute Nachricht: Datenqualität lässt sich schrittweise verbessern, ohne ein MammutÂprojekt aufzusetzen. Bitkom weist im Digitalisierungsindex Mittelstand 2025 darauf hin, dass Unternehmen, die eine strukturierte Datenpflege in den Vertriebsalltag integrieren â statt sie als Sonderprojekt zu behandeln â, innerhalb von sechs bis zwölf Monaten messbar bessere ModellÂausgaben erzielen. Drei Ansätze haben sich in der Praxis bewährt:
Der erste Hebel â erzwungene Felddisziplin â ist der unangenehmste, weil er Vertriebsmitarbeitern EingabeÂpflichten auferlegt. Er wirkt aber am schnellsten. Studien zeigen, dass schon drei bis fünf hart verpflichtende Felder (Branche, Entscheiderrolle, UmsatzÂgröÃenklasse) die ModellÂgüte eines Lead-Scorings messbar anheben, weil diese Felder für fast alle SegmentierungsÂaufgaben zentral sind.
Der zweite Hebel â automatische Datenanreicherung â hat durch die Verbreitung strukturierter FirmenÂdatenbanken und entsprechender API-Dienste deutlich an Aufwand verloren. Mittelständische Unternehmen können heute für überschaubare monatliche Kosten HandelsÂregisterÂdaten, BranchenÂcodes und UnternehmensÂgröÃen automatisch in ihr CRM zurückspielen lassen. Das ersetzt keine Entscheidung über KaufÂbereitschaft, schafft aber die Grundlage, auf der KI-Modelle überhaupt erst segmentieren können.
Der dritte Hebel â systematischer Datenverfall â wird am häufigsten übersehen. Ein KontaktÂdatensatz, der vor zwei Jahren als qualifizierter Lead eingestuft wurde, ist heute möglichweise Schrottdaten: Der Ansprechpartner hat das Unternehmen gewechselt, das Unternehmen selbst wurde übernommen, der Bedarf hat sich aufgelöst. Ohne VerfallÂmechanismus sammeln CRM-Systeme über Jahre tote Datensätze an, die das Modell weiter als TrainingsÂgrundlage verwendet.
Was das für die KI-Investitionsentscheidung bedeutet
Für Geschäftsführer und Vertriebsleiter im Mittelstand ergibt sich daraus eine klare Priorität: Bevor die nächste KI-Lösung evaluiert wird, lohnt eine ehrliche Bestandsaufnahme der eigenen CRM-Datenqualität. Das muss kein teures Consulting-Projekt sein. Eine StichprobenÂanalyse von 200 bis 300 Datensätzen â manuell durchgeführt oder mit einfachen AuswertungsÂabfragen â gibt in wenigen Stunden Aufschluss darüber, wie hoch der Anteil nutzbarer Datensätze tatsächlich ist.
Wer dabei feststellt, dass weniger als drei von fünf Feldern zuverlässig gefüllt sind, sollte den KI-Roll-out verschieben â oder parallel mit der Datenpflege beginnen und das Modell erst nach einem definierten DatenÂqualitäts-Schwellenwert produktiv schalten. Dieser Schwellenwert ist keine Wissenschaft: Forrester empfiehlt als Faustregel, dass mindestens 70 Prozent der Datensätze in den für das Modell relevanten KernÂfeldern vollständig sein sollten, bevor man auf KI-Ausgaben vertraut.
Die Alternative â KI auf schlechten Daten laufen zu lassen und die Ergebnisse zu ignorieren â ist keine neutrale Entscheidung. Sie erzeugt im Vertriebsteam das Signal, dass KI nicht funktioniert. Dieses Signal ist schwer zu revidieren. Wer den zweiten Schritt vor dem ersten tut, zahlt den Preis nicht einmal, sondern zweimal: einmal für das Tool, einmal für das verlorene Vertrauen.