ForHosting KIT · Daten & Dateien

Zwei CSV-Dateien per Schlüssel verbinden und Lücken finden

Verbinden Sie zwei CSV-Dateien über einen Schlüssel, wenn eine Tabelle die Hauptdatensätze enthält und eine zweite zugehörige Felder ergänzt.

● BetaKostenlos · im Browser
Nutzen Sie es über WebAPIE-MailTelegramApp bald

Fügen Sie beide CSV-Texte ein, nennen Sie die gemeinsame Überschrift und erhalten Sie einen vorhersehbaren Left Join, ohne eine Datenbank einzurichten oder ein temporäres Skript zu schreiben. Die Antwort weist außerdem nicht zugeordnete Datensätze beider Seiten getrennt aus. Werte in Anführungszeichen, wiederholte Schlüssel, kollidierende Überschriften und übliche Zeilenenden werden deterministisch verarbeitet.

Bereiten Sie zwei CSV-Dateien mit einem zuverlässigen Schlüssel vor

Bestimmen Sie zuerst die Spalte, die in beiden Dateien dasselbe Objekt bezeichnet, etwa customer_id, order_number, sku oder email. Die Schreibweise der Überschrift muss einschließlich Groß- und Kleinschreibung sowie Leerzeichen genau mit dem übermittelten Schlüssel übereinstimmen. Alle anderen Überschriften dürfen abweichen. Die linke CSV-Datei ist die Haupttabelle: Jeder ihrer Datensätze bleibt im verbundenen Ergebnis erhalten, unabhängig davon, ob rechts eine Entsprechung existiert. Die rechte CSV-Datei ergänzt bei passendem Schlüssel weitere Spalten. Verwenden Sie möglichst eine beständige Kennung. Namen und Beschreibungen ändern sich häufig, weisen uneinheitliche Abstände auf oder kommen mehrfach vor; eine Systemkennung ist meist sicherer. Der Parser unterstützt Felder in Anführungszeichen, maskierte doppelte Anführungszeichen, Kommas innerhalb solcher Werte, eingebettete Zeilenumbrüche, CRLF-Dateien und eine führende UTF-8-Bytereihenfolgemarkierung. Falls beide Dateien ein anderes Trennzeichen nutzen, geben Sie dieses einzelne Zeichen an. Beide Eingaben müssen dasselbe Trennzeichen verwenden. Leere oder doppelte Spaltennamen werden abgelehnt, da sie die Ergebnisobjekte mehrdeutig machen würden. Fehlt die Schlüsselüberschrift in einer CSV-Datei, erhalten Sie eine eindeutige Eingabefehlermeldung statt einer irreführenden leeren Zuordnung.

Verstehen Sie den Left Join und doppelte Schlüssel

Für jeden Datensatz der linken CSV-Datei sucht die Funktion rechts nach Datensätzen mit exakt demselben Schlüsseltext. Eine Übereinstimmung erzeugt einen kombinierten Datensatz. Ohne Treffer entsteht ebenfalls eine verbundene Zeile: Die ursprünglichen linken Felder bleiben erhalten, während alle beigesteuerten rechten Felder leere Zeichenfolgen enthalten. Gibt es rechts mehrere Datensätze mit demselben Schlüssel, wird der linke Datensatz zu einer Ausgabezeile je Treffer erweitert. Dieses Eins-zu-viele-Verhalten eignet sich etwa für einen Kunden mit mehreren Abonnements oder ein Produkt in mehreren Lagern, kann die Zeilenzahl jedoch erhöhen. Doppelte linke Schlüssel werden unabhängig voneinander in ihrer ursprünglichen Reihenfolge verarbeitet. Zeilen und Treffer behalten die Reihenfolge der Quelldateien, wodurch das Ergebnis deterministisch bleibt. Der gemeinsame Schlüssel erscheint nur einmal. Ist eine rechte Nicht-Schlüsselüberschrift bereits links vorhanden, erhält sie das Präfix right_, damit kein Wert überschrieben wird. Bei Bedarf kommen weitere Präfixe hinzu, bis jeder Name eindeutig ist. Das Array columns zeigt Ihnen die genaue endgültige Reihenfolge und Benennung, bevor Sie joined_rows weiterverarbeiten.

Stimmen Sie Daten anhand der Berichte zu fehlenden Treffern ab

Das Array unmatched_left enthält die ursprünglichen linken Datensätze, deren Schlüssel rechts keine Entsprechung hatte. Da es sich um einen Left Join handelt, stehen diese Einträge weiterhin in joined_rows; die gesonderte Liste erleichtert jedoch Korrektur, Anreicherung oder Prüfung. unmatched_right umfasst ursprüngliche rechte Datensätze, die von keiner linken Zeile verwendet wurden. Sie erscheinen nicht in der verbundenen Tabelle, weisen aber oft auf veraltete Referenzdaten, unerwartete neue Kennungen oder eine Datei aus dem falschen Zeitraum hin. Zähler fassen die Größen beider Quellen, die erweiterte Ergebnisgröße und die Anzahlen ohne Treffer zusammen. Automatische Qualitätskontrollen können dadurch einen Import ablehnen, wenn unmatched_left größer als null ist, oder bei Überschreiten eines Grenzwerts für unmatched_right warnen. Der Abgleich erfolgt exakt: Leerzeichen werden nicht entfernt, Groß- und Kleinschreibung wird nicht vereinheitlicht und Zahlen werden nicht umgedeutet. Deshalb bleiben 001, 1 und 1 mit folgendem Leerzeichen verschiedene Werte. Diese vorsichtige Regel verhindert unbeabsichtigte Verknüpfungen. Normalisieren Sie Schlüssel vorab, wenn Ihre Geschäftsregeln solche Werte ausdrücklich gleichsetzen. Für $0.002 je API-Anfrage lässt sich die Operation in wiederkehrende Importe und einmalige Untersuchungen einbauen.

Kundenexporte anreichern

Ergänzen Sie Tarif, Gebiet oder Betreuung aus einer Referenz-CSV und behalten Sie sämtliche Kunden des Hauptexports.

Bestellungen und Zahlungen abstimmen

Verbinden Sie Transaktionen per Bestellnummer und finden Sie unbezahlte Bestellungen oder Zahlungen ohne bekannte Bestellung.

Katalogabdeckung prüfen

Kombinieren Sie die SKU-Stammliste mit Lieferantendaten und erkennen Sie unvollständige Produkte sowie ungenutzte Zeilen.

Was geschieht, wenn die Schlüsselspalte fehlt?

Die Anfrage endet mit einem Eingabefehler, der angibt, ob der Schlüssel in der linken oder rechten CSV-Datei fehlt.

Bleiben alle linken Zeilen erhalten?

Ja. Es ist stets ein Left Join; ohne Treffer enthalten die beigesteuerten rechten Felder leere Zeichenfolgen.

Wie werden doppelte Schlüssel behandelt?

Jeder linke Datensatz wird mit sämtlichen passenden rechten Datensätzen kombiniert und kann mehrere Zeilen erzeugen.

Was passiert bei gleichnamigen Spalten in beiden Dateien?

Die linke Spalte behält ihren Namen; die rechte erhält das Präfix right_, bei Bedarf auch mehrfach.

Werden Schlüssel vor dem Vergleich bereinigt?

Nein. Der exakte Vergleich bewahrt Leerzeichen, Schreibweise und führende Nullen; normalisieren Sie bei Bedarf vorab.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/data/merge-csv-on-key

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/data/merge-csv-on-key \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"left_csv":"id,name\n1,Ada\n2,Linus\n3,Grace","right_csv":"id,team\n1,Research\n2,Platform\n4,Support","key":"id"}'
{
  "left_csv": "id,name\n1,Ada\n2,Linus\n3,Grace",
  "right_csv": "id,team\n1,Research\n2,Platform\n4,Support",
  "key": "id"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "data.merge_csv_on_key",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_mb25
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →