ForHosting KIT · Daten & Dateien

Statistik für eine CSV-Spalte berechnen

Verdichten Sie eine numerische CSV-Spalte zu einer übersichtlichen statistischen Zusammenfassung, ohne eine Tabellenkalkulation zu öffnen oder ein Wegwerfskript zu schreiben.

● BetaKostenlos · im Browser
Nutzen Sie es über WebAPIE-MailTelegramApp bald

Geben Sie den CSV-Text und den exakten Namen der numerischen Spalte an; Sie erhalten Minimum, Maximum, arithmetisches Mittel, Median und Populationsstandardabweichung. Jede ausgewählte Zelle wird vor der Berechnung geprüft. Fehlende Spalten, leere Zellen, Bezeichnungen, unendliche Werte und andere nichtnumerische Inhalte führen zu einer verständlichen Fehlermeldung statt zu einem irreführenden Teilergebnis. Felder in Anführungszeichen, maskierte Anführungszeichen, konfigurierbare Trennzeichen und übliche Zeilenenden werden deterministisch verarbeitet.

CSV-Text bereitstellen und eine Spalte auswählen

Verwenden Sie CSV-Text, dessen erster Datensatz die Kopfzeile bildet und dessen weitere Datensätze die Beobachtungen enthalten. Setzen Sie column auf die genaue Überschrift, die Sie auswerten möchten. Leerzeichen am Rand der Überschrift werden ignoriert; Schreibweise sowie Groß- und Kleinschreibung bleiben jedoch relevant. Dadurch wird verhindert, dass versehentlich ein anderes Feld ausgewählt wird. Standardmäßig dient das Komma als Trennzeichen. Nutzt Ihre Datei ein Semikolon, einen Tabulator, einen senkrechten Strich oder ein anderes einzelnes Zeichen, tragen Sie dieses im Trennzeichenfeld ein. CSV-Werte in Anführungszeichen werden unterstützt, einschließlich enthaltener Trennzeichen, Zeilenumbrüche und verdoppelter Anführungszeichen. Der Parser behandelt jeden Datensatz nach der Kopfzeile als Daten. Entfernen Sie daher sachfremde Fußnoten vor dem Absenden. Mindestens ein Datensatz ist erforderlich. Die Antwort nennt die ausgewählte Spalte und die Zahl der Beobachtungen zusammen mit allen fünf Kennzahlen. So können Sie die einbezogenen Werte prüfen, bevor Sie das Ergebnis für einen Bericht, eine Validierungsregel oder eine automatisierte Importentscheidung verwenden.

Die fünf ausgegebenen Kennzahlen verstehen

Minimum und Maximum beschreiben die beobachtete Spannweite. Der Mittelwert ist das arithmetische Mittel: Alle ausgewählten Werte werden addiert und die Summe durch ihre Anzahl geteilt. Der Median ist nach numerischer Sortierung der mittlere Wert; bei einer geraden Zahl von Beobachtungen wird der Durchschnitt der beiden zentralen Werte verwendet. Die Standardabweichung wird als Populationsstandardabweichung berechnet. Dazu werden die quadrierten Abstände vom Mittelwert durch die vollständige Anzahl der Beobachtungen geteilt, bevor die Quadratwurzel gezogen wird. Diese Definition passt, wenn die CSV-Spalte die gesamte zu beschreibende Population darstellt. Handelt es sich stattdessen um eine Stichprobe zur Schätzung einer größeren Population, wenden Sie in der nachgelagerten Analyse eine Stichprobenkorrektur an. Ergebnisse verwenden JavaScript-Zahlen, die auf fünfzehn signifikante Stellen normalisiert werden. Das vermeidet störende Gleitkommaartefakte und erhält zugleich sinnvolle Genauigkeit. Die Funktion erkennt keine Einheiten, entfernt keine Ausreißer, gewichtet keine Beobachtungen und deutet formatierte Währungswerte nicht um. Sie fasst exakt die endlichen numerischen Werte der gewählten Spalte zusammen.

Nachgelagerte Abläufe streng absichern

Zuverlässige Statistik setzt eine durchgängig numerische Eingabespalte voraus. Deshalb ist die Validierung bewusst streng. Die Anfrage schlägt fehl, wenn die genannte Überschrift nicht vorhanden ist oder eine ausgewählte Zelle leer, fehlend, unendlich oder keine endliche Zahl ist. Fehlerhafte Zeilen werden nicht unbemerkt übersprungen, denn eine Berechnung mit einer kleineren Datenmenge kann plausibel wirken und dennoch falsch sein. Bereinigen Sie Währungssymbole, Tausendertrennzeichen, Prozentangaben und textliche Nullwertmarkierungen, bevor Sie diese Funktion aufrufen. Die Fehlermeldung nennt die Spalte und bei einem ungültigen Zellenwert die ab eins gezählte Position der Datenzeile. Dadurch können Sie den ursprünglichen Datensatz leichter finden und korrigieren. Dieses Verhalten eignet sich als Qualitätskontrolle vor dem Einlesen: Ein erfolgreiches Ergebnis bestätigt, dass die erwartete Spalte existiert und jede Zeile an der Berechnung teilnimmt. Die Verarbeitung ist deterministisch, benötigt keinen Netzwerkzugriff und speichert keine Datei. Im Browser ist eine sofortige Prüfung möglich; jede automatisierte API-Anfrage kostet $0.002.

Einen Messdatenexport prüfen

Fassen Sie eine Sensor- oder Laborspalte zusammen und vergleichen Sie Spannweite und Streuung mit erwarteten Betriebsgrenzen.

Einen eingehenden Datenstrom validieren

Prüfen Sie vor dem CSV-Import, ob eine erforderliche numerische Spalte vorhanden ist und nur nutzbare Werte enthält.

Umfrageergebnisse beschreiben

Berechnen Sie Lage und Populationsstreuung einer numerischen Antwort ohne Formeln in einer Tabellenkalkulation.

Welche Standardabweichung wird ausgegeben?

Ausgegeben wird die Populationsstandardabweichung: Vor dem Ziehen der Quadratwurzel wird die Varianz durch alle Beobachtungen geteilt.

Werden leere Zellen ignoriert?

Nein. Eine leere oder fehlende Zelle in der gewählten Spalte erzeugt einen Eingabefehler, damit kein unbekannter Teildatensatz ausgewertet wird.

Kann die CSV ein anderes Trennzeichen als ein Komma verwenden?

Ja. Geben Sie ein gültiges einzelnes Trennzeichen an, etwa Semikolon, Tabulator oder senkrechten Strich.

Werden CSV-Felder in Anführungszeichen unterstützt?

Ja. Eingeschlossene Trennzeichen, interne Zeilenumbrüche und maskierte doppelte Anführungszeichen folgen den CSV-Konventionen.

Was kostet eine API-Anfrage?

Jede API-Anfrage kostet $0.002. Die Browserversion lässt sich für interaktive Prüfungen lokal ausführen.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/data/csv-column-stats

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/data/csv-column-stats \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"csv":"name,score\nAda,10\nGrace,20\nLinus,30","column":"score"}'
{
  "csv": "name,score\nAda,10\nGrace,20\nLinus,30",
  "column": "score"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "data.csv_column_stats",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_mb25
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →