¿Qué es un archivo NDJSON?
NDJSON — JSON por líneas
¿Qué es?
NDJSON almacena un objeto JSON completo por línea, sin corchetes envolventes ni comas entre líneas. Cada línea se lee de forma independiente respecto a las demás.
Su utilidad resulta decisiva para grandes volúmenes de datos: un fichero JSON clásico debe cargarse por completo en memoria antes de poder utilizarse. Un NDJSON se lee línea a línea, lo que permite procesar un archivo de 50 GB en una máquina que solo dispone de 8 GB de memoria.
Historia y origen
Esta convención se impuso de forma natural con el auge del procesamiento de datos en flujo continuo, a medida que los volúmenes hacían inviable la carga íntegra de un fichero.
Se convirtió en el formato estándar de facto para los registros de aplicaciones y las exportaciones de bases de datos voluminosas.
Por qué es práctico
Se procesa en flujo continuo, línea por línea, sea cual sea el volumen total del archivo.
Una línea corrupta no invalida el resto del contenido, al contrario de lo que ocurre con un JSON clásico, donde una sola coma mal colocada deja inutilizable todo el fichero.
Límites y defectos
No es un JSON válido en sentido estricto: un analizador convencional lo rechazará.
Carece de una especificación oficial, lo que da lugar a variantes.
Consejos de uso
NDJSON es el formato adecuado para registros, exportaciones masivas o flujos de datos.
Para trabajar con él en una hoja de cálculo, conviértalo a CSV, siempre que la estructura sea plana.
Convierte tu NDJSON en segundos, en nuestros servidores seguros en Francia.
Convertir un NDJSON