Beispiel-CSV-Generator (Dummy-Daten)

Definieren Sie Spaltennamen und -typen (fortlaufende ID, vollständiger Name, E-Mail, Datum, Zahlen und mehr), um sofort Dummy-CSV-Daten für Tests und QA zu erzeugen und herunterzuladen.

Unterstützte Datentypen

Typ Beispielausgabe
Fortlaufende ID 1, 2, 3, ... oder eine Sequenz mit Präfix wie USR-0001
Vollständiger Name Fiktive Namen aus japanischem und westlichem Stil, z. B. Taro Yamada, Emma Smith
E-Mail-Adresse [email protected] (automatisch aus dem generierten Namen abgeleitet)
Telefonnummer Ein Format im Stil japanischer Mobilnummern wie 090-1234-5678
Datum Ein zufälliges Datum innerhalb des gewählten Bereichs im Format JJJJ-MM-TT
Ganzzahl Eine zufällige Ganzzahl innerhalb des gewählten Min./Max.-Bereichs
Dezimalzahl (Preis usw.) Eine zufällige Dezimalzahl innerhalb des gewählten Bereichs, gerundet auf 2 Nachkommastellen
Boolescher Wert true/false (Beschriftungen anpassbar)
Freitext Ein Fülltext-Satz wie „Lorem ipsum dolor sit amet.“

CSV-Beispieldaten erzeugen

Entwicklung und Prüfung verlangen **Daten, die glaubhaft aussehen.** Produktivdaten unverändert zu verwenden sollte man meiden, wo personenbezogene Angaben im Spiel sind, und selbst zehn Zeilen von Hand zu schreiben ist mühsam. Geben Sie hier Spaltennamen und Typen an, und dieses Werkzeug erzeugt eine erfundene CSV-Datei für Prüfung und Qualitätssicherung, sofort herunterladbar.

**Dass sich ein Typ angeben lässt, ist der Kern des Werkzeugs.** Eine überall mit derselben Zeichenkette gefüllte Datei prüft weder Sortierung noch Suche. Da sich fortlaufende Kennungen, Namen, E-Mail-Adressen, Datumsangaben und Zahlen spaltenweise wählen lassen, erhalten Sie **eine Datei, deren Verteilung echten Daten ähnelt.** Alles entsteht in Ihrem Browser, nichts geht an einen Server. Die erzeugten Namen und Adressen sind erfunden und stehen in keinem Bezug zu wirklichen Personen.

So erzeugen Sie eine erfundene CSV-Datei

  1. Bestimmen Sie die Spalten Fügen Sie so viele Paare aus Spaltenname und Datentyp hinzu, wie Sie brauchen.
  2. Wählen Sie den Datentyp Wählen Sie aus fortlaufender Kennung, Name, E-Mail, Datum, Zahl und weiteren. **Jede Spalte kann einen anderen Typ tragen.**
  3. Stellen Sie die Möglichkeiten ein Manche Typen lassen einen Bereich oder ein Format genauer festlegen.
  4. Geben Sie die Zeilenzahl an Tragen Sie so viele Zeilen ein, wie Sie benötigen.
  5. Laden Sie die Datei herunter Die erzeugte CSV-Datei dient unverändert als Prüfdatenbestand.

Tipps für die Nutzung

  • Geben Sie eine beliebige Zahl in das Seed-Feld ein, um aus denselben Spaltendefinitionen immer wieder exakt dieselben Dummy-Daten zu erzeugen – nützlich beim Teilen eines Fehlerberichts oder einer Fixture für automatisierte Tests.
  • Die generierte CSV-Datei folgt RFC 4180: Werte mit Kommas, Zeilenumbrüchen oder doppelten Anführungszeichen werden korrekt in Anführungszeichen gesetzt und maskiert.
  • Die E-Mail-Spalte wird automatisch aus einer in derselben Zeile davor liegenden Namensspalte abgeleitet, sodass die Kombination beider Spalten in sich konsistente Daten ergibt.
  • Die gesamte Erzeugung läuft ausschließlich im Browser ab, es werden keinerlei Daten an einen Server gesendet – es handelt sich um vollständig erfundene Daten ohne echte personenbezogene Informationen.
  • Die Zeilenanzahl ist auf 10.000 begrenzt, damit der Browser reaktionsfähig bleibt. Bei größerem Bedarf den Seed fixieren, in mehreren Durchgängen generieren und die Dateien anschließend zusammenführen.

Wofür sich das eignet

Eine Einleseschnittstelle prüfen

**Es erübrigt den Rückgriff auf Produktivdaten** und vermeidet damit das Risiko im Umgang mit personenbezogenen Angaben.

Das Verhalten der Darstellung prüfen

Sehen Sie, ob die Anzeige langen Namen und ungewöhnlichen Zeichen standhält.

Die Leistung messen

Eine höhere Zeilenzahl zu erzeugen erlaubt es, das Verhalten bei großen Mengen zu messen.

Eine Vorführumgebung einrichten

Füllen Sie die Masken, die Sie im Verkaufsgespräch oder in einer Abnahme zeigen, mit stimmig wirkenden Daten.

Begriffe zu Prüfdaten

Erfundene Daten
Zum Prüfen erzeugte, nicht der Wirklichkeit entnommene Daten. **Die Werte sind erfunden und stehen in keinem Bezug zu wirklichen Personen.**
CSV
Ein durch Kommas getrenntes Textformat, das die meisten Tabellenkalkulationen und Datenbanken lesen können.
Fortlaufende Kennung
Eine von eins aufwärts zählende ganze Zahl, oft anstelle eines Primärschlüssels verwendet.
Grenzwerte
Werte an den Rändern – größte Länge, kleinste Zahl –, an denen Mängel auftreten. **Halten Sie sie gesondert bereit; erfundene Daten allein decken sie nicht ab.**
Maskierung
Teile von Produktivdaten zu verdecken, um sie nutzen zu können. Sie ist eine Alternative zum Erzeugen erfundener Daten, keine Abwandlung.
Zeichenkodierung
UTF-8 mit Shift_JIS zu verwechseln ist die Hauptursache für unlesbaren Text in CSV-Dateien.

Häufig gestellte Fragen

Nein, überhaupt nicht. Namen, E-Mail-Adressen und Telefonnummern werden rein mechanisch aus einer eingebauten Liste von Testnamen sowie Dummy-Domains/-Formaten kombiniert und entsprechen keiner realen Person.

Bis zu 10.000 Zeilen pro Generierung, damit der Browser nicht einfriert. Bei größerem Bedarf den Seed-Wert fixieren, in mehreren Durchgängen generieren und die entstehenden Dateien anschließend zusammenführen.

Der Seed ist die Startzahl des Pseudozufallsgenerators. Derselbe Seed mit denselben Spaltendefinitionen erzeugt stets dieselbe Abfolge von Dummy-Daten. Das ist immer dann nützlich, wenn Sie reproduzierbaren Zufall benötigen – etwa um Schritte zur Fehlerreproduktion zu teilen oder in einem Test gegen einen festen Erwartungswert zu prüfen.

Einige Vornamen sind romanisierte japanische Namen (z. B. Taro, Hanako), der Generator erzeugt aber derzeit keine Namen in Kanji oder Hiragana. Spaltennamen und Beschriftungen für Boolesche Werte akzeptieren dagegen beliebigen Freitext, einschließlich Japanisch.

Die heruntergeladene Datei ist UTF-8-kodiert. Beim direkten Öffnen in Excel können je nach Gebietsschema falsche Zeichen erscheinen; verwenden Sie stattdessen den Reiter „Daten“ in Excel und importieren Sie „Aus Text/CSV“, wobei Sie UTF-8 explizit als Dateiursprung angeben.
Tool-kun

Übrigens – Warum Tests „geseedete“ Dummy-Daten brauchen

Dummy-Daten statt echter Datensätze zu verwenden, ist in der Softwareentwicklung gängige Praxis, aus zwei Hauptgründen: dem Schutz personenbezogener Daten (echte Kundendaten gehören nicht in Entwicklungs- oder Testumgebungen) sowie der Möglichkeit, Grenzfälle und ungewöhnliche Eingaben nach Bedarf frei zu konstruieren. Genau deshalb sind Bibliotheken wie Fakers für Ruby, Faker für Python oder @faker-js/faker für JavaScript so weit verbreitet.

Rein zufällige Dummy-Daten haben jedoch einen Schwachpunkt: Sie sind nicht reproduzierbar. Schlägt ein Test nur gelegentlich fehl, lässt sich kaum unterscheiden, ob die Ursache ein echter Logikfehler oder schlicht ein zufällig generierter Sonderwert war. Ein geseedeter Pseudozufallsgenerator (seeded PRNG) löst dieses Problem: Mit demselben Seed liefert er stets exakt dieselbe Zahlenfolge – und damit dieselben Dummy-Daten –, wodurch sich Fehler viel leichter reproduzieren und Testergebnisse viel leichter überprüfen lassen.

Dieses Tool verwendet mulberry32, einen Algorithmus, der mit vergleichsweise wenig Rechenaufwand pseudozufällige Zahlenfolgen guter Qualität erzeugt und in JavaScript eine beliebte, leichtgewichtige Wahl ist. Für kryptografische Zwecke ist er ungeeignet, für die Testdatenerzeugung – wo Determinismus und Geschwindigkeit weit wichtiger sind als kryptografische Unvorhersehbarkeit – aber genau richtig.