Der boilr Agent ist live Jetzt lesen

Data Lineage zeigt, woher ein Fakt stammt.

Jedes Feld bis zur Quelle zurückverfolgbar.

Data Lineage ist die Spur hinter einem einzelnen Feld: welcher Anbieter es gefunden hat, welcher Schritt es bestätigt hat und wann, damit eine Zahl in deinem CRM etwas ist, dem du vertrauen kannst, statt etwas, das du nur hoffst.

recruiter-lexikon / data-lineage
D
Data Lineage
Data Lineage
Definiert
Definition

Die nachvollziehbare Historie eines einzelnen Datenpunkts in deinem CRM: welche Quelle ihn geliefert hat, welcher Enrichment-Schritt ihn bestätigt hat und was sich seitdem geändert hat.

Auf einen Blick
Begriff Data Lineage
Wofür Einen Datensatz bis zu seiner Quelle zurückverfolgen
In boilr Jedes Feld jederzeit nachvollziehbar
b
boilr macht aus diesem Begriff eine Task
Hier definiert · von deinem KI-Mitarbeiter umgesetzt

Data Lineage, erklärt fürs Desk.

Was es ist, warum es zählt und wie dein KI-Mitarbeiter es übernimmt.

Was es ist

Data Lineage ist die nachvollziehbare Geschichte eines einzelnen Datenpunkts: woher er stammt, was mit ihm passiert ist und was sich unterwegs verändert hat. Für einen Recruitment-Desk heißt das meist ein Feld in CRM oder ATS, die E-Mail eines Entscheiders, eine Headcount-Zahl, ein "Hiring"-Flag, und die Kette dahinter: welcher Anbieter oder welches Signal es zuerst geliefert hat, welcher Enrichment-Durchlauf es bestätigt oder korrigiert hat, und ob ein Consultant es von Hand angepasst hat, bevor es in einer Task landete. Lineage ist nicht der Wert selbst. Es ist der Weg, den der Wert genommen hat, um dorthin zu kommen.

Data Lineage ist eng verwandt mit Data Provenance, die festhält, wer oder was einen Datenpunkt ursprünglich erzeugt hat und unter welcher Autorität, und sie steht neben einem AI Audit Trail, der protokolliert, was ein System getan hat. Lineage ist enger als beide: Sie folgt einem einzelnen Datenpunkt durch jede Transformation, nicht der gesamten Systemaktivität und nicht nur seinem Ursprung. Eine verifizierte E-Mail hat eine Herkunft, welcher Anbieter sie zuerst geliefert hat, und eine Lineage: die Herkunft, plus jeden Waterfall-Schritt, jede Korrektur und jede erneute Prüfung danach.

Ein Feld ohne bekannte Quelle ist eine Vermutung mit CRM-Etikett.

Warum es zählt

Recruitment-Daten veralten und werden aus vielen Quellen zusammengesetzt, was bedeutet, dass die meisten CRM-Datensätze schon ein Flickwerk sind, bevor sie überhaupt jemand von Hand bearbeitet. Ohne Lineage ist eine falsche Zahl einfach nur falsch, ohne dass sich sagen lässt, ob sie von einem veralteten Anbieter, einer geratenen E-Mail-Konvention oder einem Tippfehler eines Consultants vor sechs Monaten stammt. Mit Lineage sieht ein Consultant genau, welches Glied in der Kette zu reparieren ist, und ob dieselbe Quelle vielleicht auch andere Datensätze leise falsch macht.

Lineage klärt außerdem Streitfälle, die sonst reines Raten wären: Zwei Enrichment-Durchläufe widersprechen sich bei der Headcount-Zahl eines Unternehmens, oder ein Jobtitel wirkt veraltet. Lineage sagt dir, welche Quelle aktueller ist und welcher Durchlauf das Feld tatsächlich verifiziert hat, statt einfach die Version zu nehmen, die zuerst geladen wurde. Das wird noch wichtiger, sobald KI das Enrichment übernimmt, denn ein System, das seine eigene frühere Vermutung korrigiert, braucht eine Aufzeichnung der Vermutung, die es korrigiert.

Wie boilr das übernimmt

In boilr trägt jedes Feld, das dein KI-Sales-Mitarbeiter in einen Account schreibt, eine verifizierte E-Mail, eine Headcount-Zahl, ein erkanntes Signal, seine Lineage direkt im Company Brain: welche Quelle es geliefert hat, welcher Schritt im Enrichment-Waterfall es bestätigt hat, und wann es zuletzt geprüft wurde. Du stehst nie vor einer nackten Zahl, ohne fragen zu können, woher sie kommt.

Diese Lineage macht das Company Brain vertrauenswürdig statt nur groß. Ändert sich ein Feld, zeigt der Datensatz, was es ersetzt hat und warum, sodass ein Consultant, der eine Task prüft, einem angereicherten Detail vertrauen kann, statt es von Hand nachzuprüfen, und deine Agentur einem Kunden oder einer Aufsichtsbehörde genau zeigen kann, wie ein bestimmter Fakt in deinem System entstanden ist.

Fragen, beantwortet.

Alles, was ein Consultant aus der Praxis über data lineage fragt, und wie boilr es umsetzt.

Was ist der Unterschied zwischen Data Lineage und einem AI Audit Trail?

Ein AI Audit Trail protokolliert die Handlungen des Systems: welches Unternehmen es bewertet, welches Signal es markiert, welche Nachricht es entworfen hat. Data Lineage verfolgt etwas Engeres: die Geschichte eines einzelnen Datenpunkts, welche Quelle ihn geliefert hat, welcher Schritt ihn verifiziert hat und was sich unterwegs geändert hat. Ein vollständiger Audit Trail kann Lineage-Informationen enthalten, aber beide beantworten unterschiedliche Fragen: "was hat das System getan" gegenüber "woher stammt dieser Fakt".

Was ist der Unterschied zwischen Data Lineage und Data Provenance?

Data Provenance hält fest, woher ein Datenpunkt ursprünglich stammt: wer oder was ihn zuerst erzeugt oder geliefert hat, und unter welcher Autorität. Lineage ist zeitlich umfassender: Sie schließt die Herkunft ein, aber auch jede Transformation, jeden Enrichment-Durchlauf und jede Korrektur danach. Provenance ist das erste Glied der Kette. Lineage ist die ganze Kette.

Warum wird Data Lineage wichtiger, sobald KI das Enrichment übernimmt?

Ein Mensch, der sich bei einer E-Mail vertippt, erinnert sich meist daran. Ein KI-System, das seine eigene frühere Vermutung korrigiert, oder zwei automatisierte Durchläufe, die sich bei der Headcount-Zahl eines Unternehmens widersprechen, hinterlassen keine solche Erinnerung, wenn die Lineage nicht aufgezeichnet wird. Ohne sie kann ein Consultant nicht unterscheiden, ob ein Feld eine frische Verifizierung ist oder ein wiederholter Fehler.

Verlangsamt das Nachverfolgen von Data Lineage das Enrichment?

Nicht, wenn es fest in den Enrichment-Prozess eingebaut ist, statt nachträglich ergänzt zu werden. Lineage ist Metadaten, die automatisch in dem Moment angehängt werden, in dem ein Feld geschrieben wird, die Quelle, der Schritt, der Zeitstempel, sodass es nichts extra kostet, sie zu erfassen und zu pflegen. Teuer wird es erst, wenn man sie nachträglich als separate Prüfung anbaut.

Wie nutzt boilr Data Lineage in der Praxis?

Jedes Feld, das boilr in den Company Brain schreibt, ein verifizierter Kontakt, eine Headcount-Zahl, ein erkanntes Signal, wird mit der Quelle, die es geliefert hat, dem Enrichment-Schritt, der es bestätigt hat, und dem Zeitpunkt der letzten Prüfung versehen. Widersprechen sich zwei Durchläufe, gewinnt die neuere, besser verifizierte Quelle, und du kannst jedes Feld jederzeit bis zu seiner Quelle zurückverfolgen.

Helen Wright
Boilr gab uns die BD-Struktur und Follow-up-Unterstützung, mit der wir in unter einem Monat den ersten Kunden unterschrieben und ein Job-Briefing gesichert haben.
Helen Wright
Managing Director, 923 Jobs

Vertrau jedem Feld. Verfolg es zurück, wenn nötig.

boilr versieht jedes angereicherte Feld im Company Brain mit Quelle und Verifizierungsschritt, damit nichts in deinem CRM eine Vermutung ist. Ein KI-Sales-Mitarbeiter pro Consultant, der mit nachvollziehbaren Daten arbeitet.