DT Data Tools

SQL sobre CSV — Consulta archivos CSV, JSON y Parquet con SQL

Ejecuta consultas SQL sobre archivos CSV, TSV, JSON y Parquet directamente en tu navegador con DuckDB-wasm. Une archivos, agrega, filtra y exporta los resultados como CSV.

🔒 Se ejecuta completamente en tu navegador — nada se carga

Drop CSV, TSV, JSON or Parquet files here or click to browse

Add several files to join them. Each file becomes a SQL view named after the file.

Ctrl/Cmd + Enter runs the query

Load a file or run the demo query. The DuckDB SQL engine (about 35 MB) downloads from this site on first use, then runs offline in your browser.

Advertisement

Consulta hojas de cálculo y archivos de datos con SQL de verdad

Las fórmulas de las hojas de cálculo son perfectas para pequeñas ediciones, pero se vuelven un suplicio cuando necesitas filtrar miles de filas, agrupar por varias columnas o combinar dos exportaciones que comparten un ID. SQL sobre CSV te permite tratar archivos de datos corrientes como tablas de una base de datos. Suelta un archivo CSV, TSV, JSON o Parquet y se convierte al instante en una vista SQL con el nombre del archivo, de modo que sales_2024.csv puede consultarse como SELECT * FROM sales_2024. Añade más archivos y podrás unirlos con join, combinarlos con union o compararlos sin importar nada en un servidor de base de datos.

El motor que impulsa la herramienta es DuckDB, una base de datos analítica diseñada para consultas rápidas sobre datos en columnas. Su dialecto SQL es muy parecido a PostgreSQL y admite joins, GROUP BY, funciones de ventana, expresiones de tabla comunes (CTE), SUMMARIZE para obtener estadísticas de columnas al instante y una amplia biblioteca de funciones de texto, fecha y matemáticas. Los nombres y tipos de columna se detectan automáticamente, y el panel de esquema muestra exactamente lo que DuckDB ha inferido para cada archivo.

Privado por diseño: todo se ejecuta en tu navegador

Muchos entornos SQL en línea te piden que primero subas tus datos. Esta página no. DuckDB está compilado a WebAssembly y se ejecuta en tu navegador, así que los archivos que añades se leen en la memoria de tu navegador y se consultan localmente. No se envía nada a ningún servidor, lo que hace que la herramienta sea adecuada para exportaciones de clientes, informes financieros, registros y otros datos que no deberías entregar a terceros. En la primera visita se descarga el motor (unos 35 MB) desde una CDN; a partir de ahí, tu navegador puede guardarlo en caché.

Consejos para consultas más rápidas y precisas

Empieza por los botones de ejemplo: Preview rows muestra una muestra de filas, Column stats ejecuta SUMMARIZE para revelar mínimos, máximos, porcentajes de valores nulos y recuentos de valores distintos, y la plantilla de join te da un punto de partida para combinar dos archivos. Pon entre comillas dobles los nombres de columna que contengan espacios o mayúsculas, por ejemplo "Order Date". Si una columna de un CSV se detecta con el tipo equivocado, conviértela explícitamente con CAST(col AS DOUBLE) o TRY_CAST. La tabla de resultados muestra hasta 1.000 filas, mientras que Export result as CSV guarda todas las filas que devolvió la consulta. Como los archivos se mantienen en memoria, los conjuntos de datos muy grandes dependen de la RAM disponible para tu navegador; los archivos Parquet suelen ser la opción más compacta.

Cómo usar

  1. Añade tus archivosSuelta uno o varios archivos CSV, TSV, JSON o Parquet. Cada uno se convierte en una vista SQL con el nombre del archivo.
  2. Revisa el esquemaComprueba los nombres de columna, los tipos y el número de filas detectados para cada archivo cargado.
  3. Escribe y ejecuta SQLElige una consulta de ejemplo o escribe la tuya y, después, haz clic en Run query o pulsa Ctrl/Cmd + Enter.
  4. Exporta el resultadoDescarga el resultado completo de la consulta como archivo CSV.

Preguntas frecuentes

¿Se suben mis archivos a un servidor?
No. Los archivos se leen en la memoria de tu navegador y los consulta DuckDB compilado a WebAssembly. El propio motor se descarga desde una CDN y tus datos nunca salen de tu dispositivo.
¿Qué formatos de archivo puedo consultar?
CSV, TSV y tablas de texto plano, arrays JSON o JSON delimitado por saltos de línea (NDJSON/JSON Lines) y Apache Parquet. Los nombres y tipos de columna se detectan automáticamente.
¿Qué dialecto SQL se admite?
El SQL de DuckDB, muy parecido a PostgreSQL. Puedes usar joins, GROUP BY, funciones de ventana, CTE, SUMMARIZE, funciones de texto y de fecha, y mucho más.
¿Cuántas filas puedo ver?
La tabla de resultados muestra las primeras 1.000 filas para que la página siga respondiendo con fluidez. La exportación CSV contiene todas las filas devueltas por la consulta.
¿Qué tamaño pueden tener mis archivos?
Los archivos se cargan por completo en la memoria del navegador, así que los límites prácticos dependen de tu dispositivo. Los archivos de decenas a unos cientos de megabytes suelen funcionar bien en un navegador de escritorio.
Advertisement