Der Forecast zählt doppelt
Zwei Datensätze zu einem Kunden tragen zwei Pipelines. Was die Vertriebsleitung addiert, gibt es in Wirklichkeit einmal.
Die Duplikat-Bereinigung läuft als eigener Bereich in Ihrer Dynamics-365-Umgebung. Sie lädt eine Tabelle im Ganzen, gruppiert phonetisch ähnliche Datensätze und macht daraus eine Arbeitsliste, die Ihr Team Gruppe für Gruppe abarbeitet — mit feldgenauer Vorschau vor jeder Zusammenführung.
Für alle, die einen gewachsenen Bestand aufräumen müssen, nicht den Einzelfall im Formular.
Firmenname
name → kc_name_soundex
emailaddress1 → kc_emailaddress1_soundex
Adresse 1: Straße 1
address1_line1 → kc_address1_line1_soundex
Adresse 1: Straße 2
address1_line2 → kc_address1_line2_soundex
Adresse 1: Ort
address1_city → kc_address1_city_soundex
Fünf Felder gleichzeitig, verglichen wird der Klang. Neben jedem Originalfeld liegt sein Soundex-Wert im Datensatz.
Duplikate entstehen im Alltag: ein Import, eine Messeliste, ein Web-Formular, ein Tippfehler, eine Rechtsform mehr oder weniger. Solange sie im Bestand liegen, ist jede Auswertung darüber eine Schätzung. Das ist kein Schönheitsfehler, das ist ein Steuerungsproblem.
Zwei Datensätze zu einem Kunden tragen zwei Pipelines. Was die Vertriebsleitung addiert, gibt es in Wirklichkeit einmal.
Kampagne und Serviceanschreiben gehen zweimal raus, mit unterschiedlichem Stand. Für den Empfänger ist das ein Unternehmen, das seine eigenen Daten nicht kennt.
Aktivitäten, Angebote und Notizen verteilen sich über mehrere Datensätze. Wer den Kunden anruft, sieht einen Ausschnitt und hält ihn für das Ganze.
Hat ein Bericht einmal doppelt gezählt, wird die nächste Auswertung sicherheitshalber daneben in Excel geprüft. Danach steuert niemand mehr mit dem System.
Im Einzelfall klärt man das am Formular. Bei einem gewachsenen Bestand braucht es eine Liste, die man abarbeiten kann. Wenn Sie zuerst wissen wollen, wie es um Ihre Daten insgesamt steht, ist das eine Frage für unser Dynamics 365 Audit.
Das Werkzeug vergleicht nicht die Zeichenfolge, sondern den Klang. Neben jedem der fünf Vergleichsfelder liegt ein Soundex-Wert im Datensatz — ein Code, der ähnlich klingende Schreibweisen auf denselben Wert abbildet. Datensätze mit demselben Code landen im selben Bucket, aus mehrfach besetzten Buckets entstehen die Kandidaten für eine Duplikat-Gruppe.
Ausgewertet wird eine ganze Tabelle, nicht der Datensatz, der gerade offen ist: Tabelle wählen, laden, Arbeitsliste. Je Gruppe steht ein Score, ein Ähnlichkeitswert. Die Entscheidung bleibt beim Menschen.
Regelbasierte Duplikaterkennung und phonetische Erkennung schließen sich nicht aus. Dieses Werkzeug bringt die zweite Ebene mit und macht ihr Ergebnis als Arbeitsliste bedienbar.
Diagnose je Vergleichsfeld
Vor der ersten Zusammenführung zeigt das Werkzeug für jedes Vergleichsfeld, ob es als Erkennungsmerkmal überhaupt trägt — mit Feldname, technischem Feldnamen, Soundex-Feld und drei Kennzahlen:
Werte gefüllt
Wie viele geladene Datensätze das Feld überhaupt befüllt haben. Ein Feld, das kaum gepflegt wird, trägt als Erkennungsmerkmal nichts.
Eindeutige Werte
Wie viele verschiedene Werte darin vorkommen. Steht fast überall dasselbe, trennt das Feld die Datensätze nicht.
Doppelte Soundex-Buckets
Wie viele Klang-Gruppen mehrfach besetzt sind. Genau dort sind Duplikate zu erwarten.

Eine Arbeitsliste ist nur dann etwas wert, wenn jede Zeile zu einem Ergebnis führt. Deshalb endet jede Gruppe entweder in einer Zusammenführung oder in einer bewussten Entscheidung dagegen.
Gruppe aus der Arbeitsliste öffnen. Jede Gruppe zeigt, wie viele Datensätze sie umfasst und welchen Score, also welchen Ähnlichkeitswert, sie hat.
Master bestimmen. Ein Datensatz der Gruppe wird zum führenden. Er ist im Zusammenführen immer enthalten.
Einbeziehen entscheiden. Jeder weitere Datensatz der Gruppe lässt sich gezielt ausschließen. Was nicht zusammengehört, bleibt draußen.
Attributvergleich lesen. Feld für Feld steht nebeneinander, welcher Wert übernommen wird und welcher nicht — Firmenname, E-Mail, beide Straßenzeilen, Ort, Telefon.
Entscheiden: zusammenführen — oder als geprüft markieren, wenn die Gruppe kein Duplikat ist. Beides ist ein Ergebnis.
Was vor dem Zusammenführen sichtbar ist
Der Master ist immer Teil der Zusammenführung. Jeder weitere Datensatz der Gruppe ist eine Entscheidung, die jemand trifft.
Beispiel aus einer Sandkasten-Umgebung
3.741
geladene Firmen-Datensätze
1.778
Duplikat-Gruppen zur Prüfung
89
Seiten Arbeitsliste
Werte eines Testlaufs in einer Sandkasten-Umgebung. Sie zeigen die Größenordnung, in der das Werkzeug arbeitet, und sagen nichts über Ihren Bestand.

Wer massenhaft zusammenführt, muss Monate später noch sagen können, warum. Das Werkzeug führt neben der Arbeitsliste deshalb zwei weitere Reiter.
Neben der Arbeitsliste steht ein eigener Reiter für den Verlauf der Bereinigung. Welche Angaben er im Detail führt, zeigen wir in der Demo, statt es hier zu behaupten.
Was jemand als geprüft markiert hat, steht in einem eigenen Reiter.
Die Arbeitsliste lässt sich filtern und seitenweise abarbeiten. Ein großer Bestand wird damit zu Etappen statt zu einem Block.
Die Bereinigung steht in der Dynamics-Navigation unter „Kunden", als eigener Eintrag neben Firmen und Kontakten. Wer bereinigt, wechselt dafür nicht die Umgebung.
Sophie Lausberg verantwortet Entwicklung und Umsetzung bei KAISERSTADT. Sie zeigt Ihnen das Werkzeug im Betrieb und ordnet mit Ihnen ein, was Erkennung und Diagnose für Ihren Bestand bedeuten.

Head of Development, Project Management & Consulting
Übersetzt Geschäftsprozesse in Dynamics-Logik, von Workshop bis Code, mit hoher Anpassungsfähigkeit.
Porträts sind KI-bearbeitet. Hinweise zur Kennzeichnung
Wir zeigen Erkennung, Diagnose und Attributvergleich am laufenden Werkzeug und besprechen, was davon in Ihrer Umgebung greift. Wenn Ihr Fall damit nicht gelöst ist, sagen wir Ihnen das.