Generador de CSV de ejemplo (datos ficticios)
Define nombres y tipos de columna (ID secuencial, nombre completo, correo, fecha, números y más) para generar y descargar al instante datos CSV ficticios para pruebas y QA.
Tipos de datos admitidos
| Tipo | Ejemplo de salida |
|---|---|
| ID secuencial | 1, 2, 3, ... o una secuencia con prefijo como USR-0001 |
| Nombre completo | Nombres ficticios que mezclan estilos japoneses y occidentales, p. ej. Taro Yamada, Emma Smith |
| Correo electrónico | [email protected] (derivado automáticamente del nombre generado) |
| Número de teléfono | Un formato tipo móvil japonés como 090-1234-5678 |
| Fecha | Una fecha aleatoria dentro del rango elegido, en formato AAAA-MM-DD |
| Entero | Un número entero aleatorio dentro del rango mínimo/máximo elegido |
| Decimal (precio, etc.) | Un decimal aleatorio dentro del rango elegido, redondeado a 2 cifras |
| Booleano | true/false (las etiquetas se pueden personalizar) |
| Texto libre | Una frase de relleno como "Lorem ipsum dolor sit amet." |
Generar datos CSV de muestra
El desarrollo y las pruebas exigen **datos que den el pego.** Usar datos de producción tal cual conviene evitarlo cuando hay información personal de por medio, y escribir aunque sean diez filas a mano resulta tedioso. Indique aquí los nombres de las columnas y sus tipos y esta herramienta genera un CSV ficticio para pruebas y control de calidad, listo para descargar al momento.
**Poder especificar un tipo es lo que da sentido a la herramienta.** Un archivo relleno con la misma cadena en todas partes no prueba ni la ordenación ni la búsqueda. Como puede elegir identificadores secuenciales, nombres, direcciones de correo, fechas y números columna por columna, obtiene **un archivo cuya distribución se asemeja a la de datos reales.** Todo se genera en su navegador y nada se envía a un servidor. Los nombres y direcciones producidos son ficticios y no guardan relación con persona real alguna.
Cómo generar un CSV ficticio
- Defina las columnas Añada tantos pares de nombre de columna y tipo de dato como necesite.
- Elija el tipo de dato Escoja entre identificador secuencial, nombre, correo, fecha, número y otros. **Cada columna admite un tipo distinto.**
- Ajuste las opciones Algunos tipos permiten precisar un rango o un formato.
- Indique el número de filas Introduzca tantas filas como necesite.
- Descargue el archivo El CSV generado sirve como datos de prueba tal cual.
Consejos para aprovecharla mejor
- Introduce cualquier número en el campo de semilla para reproducir siempre los mismos datos ficticios a partir de las mismas columnas; útil al compartir un informe de error o un fixture de pruebas automatizadas.
- El CSV generado sigue el estándar RFC 4180: los valores que contienen comas, saltos de línea o comillas dobles se entrecomillan y escapan correctamente.
- La columna de correo se deriva automáticamente de una columna de nombre completo situada antes en la misma fila, así que combinarlas produce datos coherentes entre sí.
- Todo el proceso se ejecuta enteramente en el navegador y nunca se envía nada a un servidor: son datos totalmente inventados, sin información personal real.
- El número de filas está limitado a 10.000 para que el navegador no se bloquee. Si necesitas más, fija la semilla y genera por lotes, luego combina los archivos.
Situaciones en las que resulta útil
Probar una función de importación
**Elimina la necesidad de usar datos de producción**, evitando el riesgo que acarrea manejar información personal.
Comprobar el comportamiento del diseño
Vea si la presentación aguanta ante nombres largos y caracteres poco habituales.
Medir el rendimiento
Generar un número mayor de filas permite cronometrar cómo responde el sistema ante volúmenes grandes.
Preparar un entorno de demostración
Llene con datos convincentes las pantallas que mostrará en una reunión comercial o una revisión.
Términos de datos de prueba
- Datos ficticios
- Datos creados para probar, no extraídos de la realidad. **Los valores son ficticios y ajenos a cualquier persona real.**
- CSV
- Un formato de texto separado por comas que la mayoría de hojas de cálculo y bases de datos saben leer.
- Identificador secuencial
- Un entero que cuenta desde uno, empleado a menudo en lugar de una clave primaria.
- Valores límite
- Valores en los extremos —longitud máxima, número mínimo— donde suelen aflorar los defectos. **Prepárelos aparte; los datos ficticios por sí solos no los cubren.**
- Enmascaramiento
- Ocultar partes de los datos de producción para poder usarlos. Es una alternativa a generar datos ficticios, no una variante.
- Codificación de caracteres
- Confundir UTF-8 con Shift_JIS es la causa principal de texto ilegible en los archivos CSV.
Preguntas frecuentes
A propósito — Por qué las pruebas necesitan datos ficticios "con semilla"
Usar datos ficticios en lugar de registros reales es una práctica habitual en el desarrollo de software, por dos motivos principales: proteger la información personal (evitar datos reales de clientes en entornos de desarrollo o pruebas) y poder construir libremente casos límite y entradas inusuales cuando se necesiten. Por eso son tan usadas librerías como Faker de Ruby, Faker de Python o @faker-js/faker de JavaScript.
Sin embargo, los datos ficticios totalmente aleatorios tienen una debilidad: no son reproducibles. Cuando una prueba falla de forma intermitente, resulta difícil saber si la causa es un error real de lógica o simplemente un valor inusual que se generó por casualidad en ese momento. Un generador de números pseudoaleatorios con semilla (seeded PRNG) resuelve esto: dada la misma semilla, produce siempre exactamente la misma secuencia de números, y por tanto los mismos datos ficticios, lo que facilita mucho reproducir errores y verificar resultados de pruebas.
Esta herramienta utiliza mulberry32, un algoritmo capaz de generar secuencias pseudoaleatorias de buena calidad con muy poco cómputo, y es una opción ligera muy popular en JavaScript. No es apto para uso criptográfico, pero es exactamente el tipo de algoritmo adecuado para generar datos de prueba, donde ser determinista y rápido importa mucho más que la impredecibilidad criptográfica.