Cómo citar un dataset en APA 7: Kaggle, Zenodo, INE y más
Cita datasets en APA 7: Kaggle, Zenodo, INE, Eurostat, UCI Machine Learning. Fórmula base, DOI, versión, licencia y ejemplos paso a paso.
Ver ejemplos de citas y referencias Gratis · sin registro
En trabajos con análisis de datos secundarios —muy habituales en TFG y TFM de ciencias sociales, económicas, salud y ciencias de datos— es imprescindible citar las fuentes de los datos. APA 7 incorporó en su séptima edición una fórmula específica para datasets que resuelve los casos más frecuentes.
¿Dataset o informe? Aquí tratamos los datos descargables en sí (tablas, microdatos, conjuntos en Kaggle, Zenodo, INE/INEGI/DANE). Si lo que citas es el documento textual que interpreta esos datos —un reporte o estudio redactado—, usa cómo citar un informe en APA 7.
Fórmula base
Apellido, N., & Apellido2, N2. (Año). Nombre del dataset (Versión X) [Conjunto de datos]. Repositorio o institución.
https://doi.org/xxxxx
Desglosada:
- Apellido, N.: autor o autores del dataset. Si es un organismo (INE, Eurostat, OMS), pone la institución como autor corporativo.
- (Año): año de publicación o de la versión que usas.
- Nombre del dataset: en cursiva.
- (Versión X): si el dataset tiene versiones. Inclúyela si la fuente identifica una versión.
- [Conjunto de datos]: descriptor de tipo de obra en español. APA en inglés usa [Data set].
- Repositorio o institución: el origen del dataset.
- DOI o URL: identificador permanente. Preferible el DOI. Si no hay DOI, la URL más estable.
Ejemplos
Dataset de Zenodo (con DOI)
Los ejemplos de formato son ilustrativos: sus nombres, fechas y textos no acreditan la existencia de una publicación. Sustituye los datos y cualquier campo entre corchetes por los de tu fuente. Las referencias con DOI comprobado permiten consultar el registro original.
Acosta Lopez, J. M., & Acosta Armenta, H. D. (2026). Base de datos primaria: correlación entre autoestima y estrés cotidiano en estudiantes de educación primaria. FEFyDE-UAS 2025 [Conjunto de datos]. Zenodo. https://doi.org/10.5281/zenodo.20199146
Los datos de autoestima y estrés cotidiano proceden de una base primaria depositada en Zenodo (Acosta López y Acosta Armenta, 2026).
Dataset de Kaggle
Kaggle asigna DOI a muchos datasets desde 2022. Si no tiene DOI, usa la URL de la página del dataset:
Singh, A. (2022). Student performance in exams [Conjunto de datos]. Kaggle. [URL de la fuente]
Singh, A. (2022). Student performance in exams [Conjunto de datos]. Kaggle. [URL de la fuente]
Dataset del INE (Instituto Nacional de Estadística)
Instituto Nacional de Estadística. (2024). Encuesta de Población Activa (EPA): resultados nacionales, series históricas desde 1976 [Conjunto de datos]. [URL de la fuente]
(Instituto Nacional de Estadística, 2024)
Dataset de un instituto de estadística de LATAM (INEGI, DANE, INDEC)
Los institutos nacionales de Latinoamérica actúan como autor corporativo, igual que el INE de España.
Instituto Nacional de Estadística y Geografía. (2024). Encuesta Nacional de Ocupación y Empleo (ENOE): microdatos [Conjunto de datos]. [URL de la fuente]
Dataset de Eurostat
Eurostat. (2025). Early leavers from education and training by sex [Conjunto de datos]. Comisión Europea. [URL de la fuente]
Repositorio UCI y conjunto concreto
Dua, D., & Graff, C. (2019). UCI Machine Learning Repository [Conjunto de datos]. University of California, Irvine, School of Information and Computer Sciences. [URL de la fuente]
La referencia al repositorio completo no sustituye la del conjunto utilizado. Este es un dataset concreto con DOI comprobado:
Fisher, R. A. (1936). Iris [Conjunto de datos]. UCI Machine Learning Repository. https://doi.org/10.24432/C56C76
Dataset con versión explícita (Figshare)
Ambros Pallares, A., & Abarzúa, L. (2026). Transcripciones de fragmentos de entrevistas de tres estudiantes del Grado de Educación Infantil de la Universidad de Barcelona (Versión 1) [Conjunto de datos]. Figshare. https://doi.org/10.6084/m9.figshare.32256999.v1
Datos de organismos oficiales: OMS, Banco Mundial
Banco Mundial. (2024). World Development Indicators [Conjunto de datos]. [URL de la fuente]
Cómo mencionar los datos en el texto del método
Modelo ficticio de redacción, no una muestra real extraída por CitaAPA:
«Se utilizaron datos secundarios procedentes de la Encuesta de Población Activa (Instituto Nacional de Estadística, 2024) para el período 2015–2023. El análisis se realizó sobre una submuestra de 45.000 registros correspondientes a personas de entre 18 y 35 años.»
Errores habituales
| Error | Corrección |
|---|---|
| Omitir [Conjunto de datos] | El descriptor identifica el tipo de obra y es obligatorio |
| Usar URL de búsqueda en lugar de la URL permanente del dataset | Usa DOI o la URL específica del dataset, no la de los resultados de una búsqueda |
| No incluir la versión cuando existe | La versión es relevante porque el dataset puede actualizarse |
| No citar el dataset en el texto del método | Cada fuente de datos debe citarse donde se describe su uso |
Fuentes de esta guía
Comprueba el modelo que corresponde a tu fuente
El catálogo de guías cubre más tipos que los formularios del generador. Usa la estructura de la fuente concreta y revisa sus datos.
Dudas frecuentes
Preguntas frecuentes
01 ¿Debo citar los datasets que uso en mi investigación?
Sí. APA 7 incluye los conjuntos de datos como un tipo de obra citable con su propia fórmula. Citar el dataset permite a los lectores verificar tus datos, reproducir el análisis y dar crédito a quienes recopilaron la información. En investigación cuantitativa y en TFG/TFM con análisis de datos secundarios es práctica obligatoria.
02 ¿Qué es un DOI de dataset y dónde lo encuentro?
Es un identificador permanente, igual que el DOI de un artículo, pero asignado al conjunto de datos. Repositorios como Zenodo, Figshare o Dryad asignan DOI automáticamente. En Kaggle, busca el dataset y ve a «More» → «DOI». Si no hay DOI, usa la URL permanente del dataset.
03 ¿Cómo cito datos del INE o Eurostat?
El INE y Eurostat actúan como autores corporativos. Usa el nombre de la tabla o consulta como título, el año de publicación y la URL de la descarga o de la consulta concreta. Si el conjunto de datos tiene un nombre de publicación oficial, úsalo en cursiva.
Continúa con tu trabajo